「推理与计算」共找到 7989 篇相关文章
软银与英特尔合作,开发AI存储芯片
Nikkei消息,软银与英特尔宣布成立合资公司Saimemory,开发适用于AI的堆叠式动态随机存取存储器原型,目标两年内降低50%功耗,实现与高带宽内存相当性能。双方注资7000万美元,各有布局目的。
新版Claude曝光:“极限推理”成最大亮点
O家刚免费上线GPT - 4.1,A家新版Claude Sonnet和Claude Opus被曝即将发布,亮点是“极限推理”,能在推理和工具使用间建立动态循环,更智能处理问题,预计未来几周发布,虽有网友质疑,但也有实测证据。
Sutton 的批评与反思:AGI 的下一步是什么?
文章是对 Richard Sutton 采访的反思,指出 LLM 训练效率低、依赖人类数据,未实现有机自主学习。作者与 Sutton 有分歧,认为模仿学习与强化学习互补,还探讨持续学习,称 Sutton 批评有启发性。
The Batch: 939 |在推理阶段学习长上下文
大型语言模型处理长上下文时通常准确性降低、速度变慢,研究人员提出TTT - E2E方法,通过推理时训练模型将上下文压缩到transformer权重中,还展示了其运作方式、测试结果等。
小米的中国芯,与雷军没说的“四个秘密”
本文围绕小米玄戒芯片展开,介绍其推出背景、工艺选择、研发成本及应用前景。指出华为、OPPO调整业务给小米带来契机,3nm工艺因品牌与成本平衡成首选,还分析了自研成本和知识产权等挑战。
AI「第二章」开启,未来看应用与Agent!
文章基于对一线投资机构访谈,指出AI开启新篇章,模型投资降温,应用时代来临。还探讨DeepSeek与Manus影响、Agent发展路径、AI原生硬件等多领域现状与趋势,为创业者和投资人提供参考。
UserBench 与 UserRL 带来的交互智能范式转向
当下大模型在与用户交互时存在不足,来自UIUC与Salesforce的UserBench和UserRL两篇新作,将‘用户价值’量化,把‘可测的交互’转化为‘可训练的策略’,从评测和训练层面推动模型向‘懂用户’转变。
告别「盲目自信」,CCD:扩散语言模型推理新SOTA
华为小艺香港团队等研究人员提出上下文一致性解码算法(CCD)。它解决传统DLM推理“短视”和采样预算固化问题,在开源DLMs上实现3.48倍加速和3.9%性能提升,适配多种解码设定。
OpenCode AI编程实践:利用推理路由低成本开发游戏
文章介绍用 OpenCode 结合 DigitalOcean 推理路由器开发点球大战游戏 PK Shootout。其按任务选模型,多数任务路由到 MiMo V2.5 和 GLM - 5.2,成本约 8.25 美元,远低于只用前沿模型。文中还分析开发各环节及适用场景。
中国AI芯片如何破局?这家公司重注推理芯片
2月3日,云天励飞董事长陈宁在战略前瞻会表示要All in AI大算力推理芯片,打造“中国版TPU”。他认为2025 - 2035年是推理芯片高光时刻,还介绍了公司技术壁垒、差异、战略及生态等内容。