成本管控」共找到 1737 篇相关文章

推荐文章7

21

本文聚焦vllm v1中模型分布式推理的核心Executor部分,介绍其4种类型及适用场景,以mp类型为例阐述Executor - Workers架构,还说明了大小数据在两者间的传输机制及原理。

猛猿
算法论文7

拟合接近满分,外推却会跑偏:Meta 给缩放律加了一个指数

大模型训练前,团队常用 Chinchilla 缩放律估算模型规模和数据量,但它在模型和数据极不平衡的边界预测易跑偏。Meta FAIR 提出的 Skaling 只增加一个耦合指数,降低外推误差,还采用 L 形采样降低试算成本

深度学习自然语言处理
新闻资讯7

Sonnet 5 翻车!同性能价差最高 56倍,海外巨头为何复刻不出 DeepSeek?

Anthropic发布Claude Sonnet 5,官方称补足了Agent能力,价格优惠,但开发者反应不佳。Sonnet 5因tokenizer换代,实际使用成本更高,且比同类模型贵。与之相比,DeepSeek V4 Pro便宜很多,其靠技术实现低价,海外厂商难以复刻。

鲸选AI
7

拿下五角大楼大单后,OpenAI被曝开始向北约推销军事化AI

刚拿下五角大楼大单,OpenAI 转头向北约推销军事化 AI。其 CEO 奥特曼称要覆盖北约「所有机密网络」,后解释为「非机密网络」。Anthropic 因坚守安全红线被国防部出局,OpenAI 却拥抱军工,其「护栏工程学」难风险。

新智元
新闻资讯8

首个智能体商业信任协议来了!支付宝携手千问 App、淘宝闪购等发布 AI 商业协议 ACT

1 月 16 日,支付宝联合千问 App 等伙伴发布 ACT 协议,它是中国首个面向 Agent 商业需求的开放技术协议。该协议打造 AI 与服务平台‘通用语言’,解决授权、安全等问题,让操作更放心,还降低商家对接成本

InfoQ
推荐文章7

视频播客不是内容升级,更像是一场分发补偿

文章从创作者视角出发,阐述部分主播需考虑做视频播客的原因。指出媒介融合下“节目”成最大公约数,美国主播因生存需做YouTube,中国播客靠切片传播,专业创作者做视频成本低且杠杆效应大。

乱翻书
新闻资讯7

Meta发最强模型打响价格战,小扎对谷歌贴脸开大!北大校友立大功

九月刚过3天就有五个前沿模型发布,Meta发布Muse Spark 1.3踢馆谷歌Gemini 3.8 Flash。它跑分提升大、成本低,性价比高,但也遭质疑,大模型下半场或比拼系统架构和智能体工程能力。

新智元
新闻资讯7

首次曝光!OpenAI新一代旗舰Astra换上“循环深度”推理架构:用计算深度换参数规模

9月2日消息,OpenAI将推出的旗舰模型Astra采用“循环深度”新技术,用较小模型实现庞大模型性能,降低成本。但该技术会让AI推理过程不可读,加重安全担忧,此前奥特曼已因Astra“能力过强”踩刹车。

AI前线
推荐文章8

复旦硬核青年:破解核材料百年难题,为人造太阳锻造不灭铠甲

张宏亮童年时便渴望稳定电力,考入复旦后历经行业寒冬。他深耕核材料研究,取得多项成果,能用新技术降低成本、能耗,揭示材料新机制,回国后又搭建研究系统、优化工艺等,还看重产学研结合和跨界融合。

DeepTech深科技
新闻资讯7

Claude 最歧视的,是印度阿三

AI研究员Aran Komatsuzaki实验发现,Claude的tokenizer对非英语用户不友好,印地语用户消耗token是英语的3.24倍,带来高成本、高延迟等问题。不同模型对不同语言token处理有差异,市场份额影响token效率。

AGI Hunt