再思考能力」共找到 3855 篇相关文章

算法论文8

TRM思考奖励模型上线,大模型推理质量终于能量化了 | ICML‘26 Oral

大模型推理评测多只看答案,忽略推理过程。上海多校团队提出TRM,用ME² principle刻画推理质量,DAG-based pairwise evaluation还原结构,训练奖励模型,让推理质量可度量、训练和优化。

量子位
新闻资讯8

“守成者”库克卸任CEO:除了离开,他没有什么能留给苹果了

4月20日晚苹果宣布,库克2026年9月1日起转任董事会执行主席,硬件工程高级副总裁John Ternus接任CEO。库克掌舵15年将苹果带到新高度,但苹果在AI浪潮中表现保守,换帅或让苹果重回科技中心。

InfoQ
算法论文8

东南大学耿新团队:模型不是不会做,而是被「挤掉了能力」丨CVPR 2026

东南大学耿新团队针对模型多任务融合问题提出论文《Model Merging in the Essential Subspace》。指出多任务融合失败源于关键方向重叠冲突,提出 ESM 方法,能让不同任务在模型中稳定共存,实验显示其性能更优。

AI科技评论
新闻资讯7

郎园 Station Pet&Me|园区宠物友好升级,以爱筑就人宠共生小天地

首创•郎园Station位于朝阳区东坝,是北京国际化潮流文化地标,2025年园区年度客流量450万人次。产业上,它运营AIGC视听产业创新中心,携手多家企业构建全产业链生态,影视后期制作企业占国内超60%份额。

郎园Station
推荐文章7

99%的人只发挥出了龙虾的1%的能力:龙虾邪修养法

博主Alex Finn分享让OpenClaw效能提升100倍的核心方法论,即构建专属任务控制中心。介绍了任务看板、日历面板等核心工具模块,还指出不要盲目抄袭,要用反向提示词定制工具面板。

AI寒武纪
产品应用8

谷歌Alpha家族登Nature封面!刷新基因组预测SOTA,精准定位远端致病突变

谷歌Alpha家族新成员AlphaGenome登Nature封面,将AI预测拓展到人类基因组图谱。它能综合预测11种基因调控过程,精准定位远端致病突变,性能超现有程序,已面向非商业研究开放API。

量子位
新闻资讯8

Bengio 15 年前论文夺 AAAI 奖!AI 正告别单纯炫技,走向真实世界

全球人工智能顶会AAAI揭晓年度奖项,Yoshua Bengio 2011年论文获经典论文奖。今年5篇杰出论文研究方向指向AI从炫技走向应用,如ReconVLA改进VLA视觉感知,CADYT解决连续时间因果结构学习空白等。

InfoQ
新闻资讯7

Anthropic深夜出杀招!编码AI一键清空桌面,白领末日来临?

Anthropic推出办公神器Cowork,复用Claude Code底层逻辑,可完成日常任务,如整理桌面、处理文件等。它上手门槛低,主动性强,还能持续升级。不过其诞生或冲击初创公司,也需留意使用权限和安全问题。

新智元
新闻资讯7

近十年后谷歌与波士顿动力「牵手」,这次要为人形机器人注入「灵魂」

近日,在 CES 2026 上,波士顿动力与谷歌 DeepMind 宣布达成全新 AI 合作,将 Gemini Robotics AI 模型与 Atlas 人形机器人深度整合,赋能其完成工业任务,首个应用领域是汽车行业。双方曾有过交集,此次合作被网友看好。

机器之心
算法论文8

重新思考RLVR中的熵正则:从探索不足到探索过度的破局之路

2024年以来,RLVR使大模型在推理任务有显著突破,但实践中探索机制易失衡。传统熵正则化在LRM场景易走向极端,研究团队提出SIREN方法精准调控探索,实验显示其在多模型和数据集上性能提升显著。

深度学习自然语言处理