「自适应」共找到 1245 篇相关文章
低Token高精度!字节复旦推出自适应推理框架CAR
字节与复旦大学研究人员提出自适应推理框架CAR,能根据模型困惑度动态选短答或长推,在多基准测试中平衡了准确性与效率,打破长文本推理必然性能更好的认知。
OpenAI也缺卡!僧多粥少,自曝内部抢卡抢到发疯
OpenAI正面临绝对的算力稀缺,总裁Greg Brockman自曝内部算力资源争夺严重。算力是创新根本驱动力,因资源有限,许多产品无法发布,如ChatGPT Pulse部分功能仅对Pro用户开放。OpenAI有资源分配机制,但平衡各团队需求不易。
刚刚,Ilya Sutskever宣布自任CEO:联创被Meta挖走了
周五凌晨,OpenAI 联合创始人 Ilya Sutskever 宣布自任 Safe Superintelligence(SSI)首席执行官,原 CEO Daniel Gross 已退出。此前有 Meta 欲收购 SSI 的传闻,Gross 或转去 Meta 负责人工智能产品。
苹果AI自研不动,库克外包给谷歌Gemini了
今天凌晨,苹果与谷歌官宣达成深度合作协议,基于Gemini模型和谷歌云技术构建下一代苹果基础模型,成果之一是今年内上线“更个性化的Siri”。此前苹果自研AI推进不顺,人才流失严重。
ICML 2026 | Agentic强化学习训练的信息自锁问题
随着大语言模型走向真实交互,强化学习训练LLM agents时出现信息自锁问题。香港中文大学等研究者分析其原因并提出AREW方法,在多场景实验中表现稳定且具鲁棒性。
苹果或搁置自研模型,转向依赖OpenAI或Anthropic
苹果正考虑用第三方AI模型驱动Siri,这是其在AI竞赛中的重大转向。目前苹果多为自研技术,评估外部模型项目已启动,虽未做最终决定,但或借此摆脱AI落后声誉。网友对此看法不一。
比肩英伟达H20!阿里自研PPU浮出水面
1月29日,阿里旗下平头哥官网公布高端AI芯片“真武810E”信息,标志“通云哥”协同体系亮相。该芯片全栈自研,已服务超400客户。其PPU架构性能比肩英伟达H20,性价比更高,阿里还支持平头哥探索独立上市。
The Batch: 873 | 通过自监督学习实现更好得图像处理
Meta等团队发布DINOv3权重和训练代码,参数规模扩6倍,用更多数据并引入新损失函数。它在图像分割和深度估计表现卓越,解决了自监督训练的视觉transformer的问题,提升全局和局部任务表现。
突发!OpenAI「掀桌」:自研推理芯片「墨西哥辣椒」跑赢英伟达
OpenAI公布自研推理芯片Jalapeño(墨西哥辣椒)测试结果,它专为大语言模型推理设计,能同时提升吞吐量和降低延迟,在多模型测试中超NVIDIA系统。该芯片与Cerebras合作,计划2026年底部署。
扩散语言模型写代码!速度比自回归快10倍
Inception Labs推出基于扩散技术的大语言模型Mercury,它突破自回归模型限制,生成速度快,还解决了难以回头调整的问题。实测显示其代码生成速度比传统工具最多快10倍,且有强大纠错能力,但面临与当前CI能力不匹配问题。