「新推理模型」共找到 9817 篇相关文章
让机器人学会「预判接触」:它石智航牵头四大顶尖机构发布TacForeSight,破解精细操作难题
它石智航联合四大顶尖机构发布论文 “TacForeSight: Force-Guided Tactile World Model for Contact-Rich Manipulation”,提出力条件触觉世界模型,让机器人能提前预判接触变化,在真机验证中性能优异。
BrowseComp等评测集第一,秘塔推出「深度研究」,已开启免费公开访问
世界变化快,AI领域新概念不断。秘塔在上线“浅度研究”五个月后,将其升级为“深度研究”。该模块最初由OpenAI推出,秘塔版可免费公开访问,准确率优,还让研究过程可见。
ICML 2025 | 清华、上海AI Lab提出专家级医学基准MedXpertQA,看o3、R1哪家强
本文由清华和上海AI Lab学者撰写,提出专家级医学基准MedXpertQA。现有医学基准难度和临床相关性不足,而MedXpertQA极具挑战、临床相关性高,构建严格,评测显示前沿模型在医学领域提升空间大。
下载量超 1300 万,昇思 MindSpore:AI 框架迈入“超节点时代”
开源五周年,昇思 MindSpore 成绩亮眼,下载量超 1300 万。它完善大模型、部署、科学计算等核心能力,还提出 HyperParallel 架构应对新挑战,正式版及套件明年上半年发布,未来社区将多方向推进。
OmniInsert:全新无掩码视频插入技术
基于扩散模型的视频插入技术发展快,但以往方法有局限。字节提出InsertPipe和OmniInsert,解决数据不足等难题。OmniInsert设计巧妙,还建立评测平台InsertBench,虽有小问题,但推理快,可加速优化。
国家定调「人工智能+」:中国AI十年三步走,战略解读来了
2025年8月国务院印发《行动意见》,为AI发展绘就至2035年蓝图。提出“三步走”,还聚焦模型、数据、算力、开源等方面发展,强调监管安全,体现中国AI发展新方向与治理新思路。
硅谷惊变:12万张H100的挽歌
这是虚构故事,Meta用12万张英伟达H100训练“LLaMA 4 Maverick”,却被中国杭州DeepSeek团队用2000张GPU打败。项目失败成丑闻,扎克伯格成立实验室四处收购遇冷,新负责人管理混乱,实验室乌烟瘴气。
“Claude Skills很棒,可能比 MCP 更重要”
10月17日,Anthropic发布Claude Skills,是助其模型获新功能的模式。Claude用Skills可改进执行特定任务方式,且只在相关时调用。它易共享,可能比MCP更重要,实现依赖编码环境。
Claude Sonnet 4.5发布,多领域性能超越GPT-5和Gemini 2.5 Pro
Anthropic发布Claude Sonnet 4.5,是目前最强编程模型,在多领域性能超GPT - 5和Gemini 2.5 Pro。操作电脑、数学推理能力提升,产品更新功能丰富,安全性增强,价格不变,获多家公司认可。
Transformer与RNN合体,谷歌打下显存门槛,解锁超长上下文
谷歌论文提出 Memory Caching 技术,通过架构机制创新赋予 RNN「可生长的记忆容量」,兼顾 Transformer 与 RNN 优势,能处理更长文本、降低推理资源门槛,实验显示有良好效果。