显示痛点」共找到 2127 篇相关文章

算法论文8

微信、清华连续自回归模型CALM,新范式实现从「离散词元」到「连续向量」转变

腾讯微信 AI 联合清华提出连续自回归语言模型 CALM,它将语言建模为连续向量而非离散词元,显著改善性能与计算成本权衡,解决了 LLM 效率瓶颈,虽面临技术挑战但实验效果佳,还指明未来研究方向。

机器之心
算法论文8

推翻「预测下一个token」范式!微信AI新研究:把token压缩成连续向量更具性价比

微信AI和清华团队提出新范式CALM,把token打包成连续向量,让大模型从预测下一个token转变为预测下一个向量。实验表明它能减少生成步骤,在平衡性能和计算成本时性价比更高。

量子位
新闻资讯7

微软独家:OpenAI最新季度净亏损115亿美元

微软2025年第三季度财报显示,因OpenAI投资亏损31亿美元。按微软持股比例推算,OpenAI上季度净亏115亿美元。不过,这或为研发支出,是AI产业“囚徒困境”,微软也在战略补贴。

量子位
8

刚刚!Kimi Linear横空出世,全新注意力架构:1M长文本解码速度飙升6.3倍,KV缓存砍掉75%

月之暗面推出全新注意力架构Kimi Linear,有望成下一代Agent LLM基石技术。它解决了LLMs处理长序列任务的瓶颈,性能超传统机制,还开源了核心代码。Kimi Linear的KDA模块提升了表达和硬件效率,实验表现佳。

AI寒武纪
开源动态8

Thinking Machines 发布又一神作「在线策略蒸馏」 ,LLM后训练效率飙升50-100倍

Mira的THINKING MACHINES开源「在线策略蒸馏」LLM后训练方法,结合两种主流后训练范式优,提升训练效率50 - 100倍,成本降低9到30倍,可用于数学推理、模型个性化等场景。

AI寒武纪
算法论文8

快手Klear团队提出CE-GPPO:通过梯度保留协调熵,解决强化学习中的熵不稳定问题

快手 Klear 语言大模型团队提出新强化学习算法 CE - GPPO,以「熵」为核心,提出梯度保留策略,重新利用裁剪外区间低概率 token 的梯度,实现策略熵的精细调控,解决强化学习中熵不稳定问题。

机器之心
推荐文章8

SemiAnalysis 创始人解析万亿美元 AI 竞争:算力是 AI 世界的货币,Nvidia 是“中央银行”

SemiAnalysis 创始人 Dylan Patel 在访谈中指出,AI 是算力、资金与地缘政治驱动的产业迁徙。算力成新货币,Nvidia 似央行。还谈到 AI 竞争格局、技术路线、算力人才能源问题,以及对传统软件和各玩家的影响。

海外独角兽
开源动态8

AI牛马实现“干中学”!上海AI Lab联合推出智能体自我进化新框架

上海人工智能实验室等研究者提出MUSE智能体框架,让智能体实现“干中学”。它围绕分层记忆模块,通过先做、再反思、然后进化,解决现有智能体,实验表现出色,还展望了未来优化方向。

量子位
新闻资讯8

腾讯发布超低成本AI训练法!120元效果秒杀70000元微调方案

腾讯提出无训练组相对策略优化Training-Free GRPO,无需调整参数,在提示词中学习经验就能提升模型性能。实验显示,该方法在数学推理和网页搜索任务上效果显著,成本远低于传统方法。

量子位
7

Anthropic CEO再预警:未来5年砍掉一半入门岗,失业率10–20%

数据显示,2025年美国超一万岗位因引入AI被裁撤。Anthropic CEO Dario Amodei重申观,未来五年最多一半入门级办公室岗位或被淘汰,失业率或达10% - 20%,各方就应对就业冲击存争议。

新智元