「算力竞赛」共找到 931 篇相关文章
RL救不了泛化性!揭示LLM数学Reasoning的深层瓶颈
大型语言模型在数学竞赛级任务依赖机械化推理,现有评测集有缺陷。UC Berkeley团队提出OMEGA基准量化其数学泛化能力,实验揭示复杂度引发性能崩塌等问题,指出LLM创新组合难,给出改进方向。
HBM Roadmap和HBM4的关键特性
文章介绍 KAIST TERALAB 公布的 HBM 技术,涵盖 HBM 路线图和 HBM4 特性。HBM 路线图展示从容量升级到计算存储融合的进化,HBM4 在电气规格、封装冷却、架构等方面有突破,AI 工具也用于研发。
40位数学家组成8队与o4-mini-medium比赛,6队败北
Epoch AI安排40位数学家组成8支战队,与OpenAI的o4 - mini - medium模型对决,考题来自高难度的FrontierMath数据集。结果AI以6:2击败人类,不过Epoch AI认为AI未明显超人类,但很快会达到。
DeepSeek-R1发布后的100天复现之旅方法总结
DeepSeek团队发布「推理大模型」DeepSeek-R1 ,其技术细节未完全开源,全球研究团队开启“复现竞赛”。论文总结100天复现经验,介绍推理大模型与普通大模型区别、复现方法、关键发现及未来方向。
别高估车企“造人”
今年5月特斯拉停产后搭建Optimus量产线,虽强调FSD算法可复用,却未量产。车企造机器人,优势在供应链管理和生产制造,算法移植效果一般,且面临数据难题,竞赛中暂无通关密码。
Anthropic深夜连放两弹:Sonnet 5、全新AI科研App重磅上线
Anthropic 深夜发布两个重磅更新:Claude Sonnet 5和面向科研人员的AI工作台Claude Science。Sonnet 5性能接近Opus 4.8,提升Agent能力且价格低;Claude Science整合科研工具,支持复现产出、自动管理算力、多学科查询。
中国光芯片迎来“迈向高端”黄金窗口期
近期光芯片领域热度攀升,政策、产业、资本利好。AI算力爆发使光芯片从‘通信管道’升级为‘战略性资源’,需求大增但供给端短板凸显。本土产业链分层,高端赛道迎来突破窗口期,有三条主流技术路线。
SpaceX一分现金没花收购Cursor,马斯克吞下AI编程工具第一名
SpaceX在IPO第四天,以600亿美元全股票方式收购AI编程工具Cursor母公司Anysphere。Cursor商业增长快,但市场份额下降且算力不足。收购是马斯克算力布局收尾,还将发布联合模型及编程代理工具。
刚刚,中国AI闯入全球编程前二!前面只剩Claude
Code Arena最新榜单出炉,Qwen3.7 - Max以1541分冲进全球第四,是前五中唯一非Claude模型。它在多项测试中表现出色,是为长时间自主执行任务设计的Agent基座模型,编程跃升或与环境扩展、长程自主执行训练方法升级有关。
OpenAI差点没了?总裁亲述:奥特曼被罢免当天,我就辞职了
OpenAI联合创始人兼总裁Greg Brockman在播客复盘2023年11月奥特曼被罢免的72小时,讲述公司治理结构的崩塌与重建,还谈及OpenAI从非营利到营利的转变、未来押注方向及算力等问题。