推理时纠错」共找到 2622 篇相关文章

算法论文8

61.3%!「人类最后一场考试」AI终于及格了,揭秘Agent自我进化新路径

上海交通大学等联合团队提出MemRL框架,在不微调模型参数下,让AI在“人类最后一场考试”中准确率跃至61.3%。该框架受人类认知科学启发,解耦推理与记忆,实验表现出色,或为AGI提供高效路径。

AI科技评论
新闻资讯7

薛定谔亲外孙创业量子计算,老黄早早就成了股东

PsiQuantum由薛定谔外孙参与创办,获10亿美元巨额融资,欲2028年造百万比特级量子计算机。其量子比特基于光子,有生产优势,不过纠错能力待验证。公司团队学术背景强,项目多为政府大单。

量子位
算法论文8

让机器人学会系统2慢思考,叠衣服倒咖啡等不在话下 | 上海交大&智元机器人

上海交通大学与智元机器人等团队推出Hume——融合系统2慢思考的双系统VLA模型。它结合深度推理与实控制,在多种机器人平台实验中表现出色,平均成功率达91%,显著超越现有模型。

量子位
产品应用8

首个实端侧部署世界模型,20万小人类视频,BeingBeyond实现「两级跃迁」

4月14日,BeingBeyond发布具身世界模型Being - H0.7,将人类视频规模扩至20万小,采用隐式推理范式,6项权威评测综合第一。还率先实现端侧实部署,打通数据闭环,推动模型通用与专家能力跃迁。

AI科技评论
推荐文章8

这一年做 Agent 的公司,Coding 赚了钱,客服融了钱,你呢?

全球数据研究机构 CB Insights《AI Agent Bible》报告梳理 Agent 行业概况。指出未来趋势,如语音成主流交互等;分析发展受限问题、有潜力机会;还介绍不同类型 Agent 商业情况及应对推理成本策略等。

Founder Park
新闻资讯7

The Batch: 876 | Gemini 的环境影响测算

谷歌研究人员对驱动 Gemini AI 助手的模型进行一年研究,发现处理一个提示的环境影响小。其能耗、水耗和温室气体排放量远低于此前估算,2024 - 2025 年处理中位提示能耗、排放大幅降低。

DeeplearningAI
算法论文8

强化学习的两个「大坑」,终于被两篇ICLR论文给解决了

现有强化学习算法基于理想化交互模式,难应对真实环境。Mila 实验室两篇 ICLR 2025 论文提出实强化学习框架,分别解决推理延迟和动作缺失问题,还可结合使用,对关键领域意义重大。

机器之心
开源动态8

10B超越Gemini-2.5-Pro!阶跃星辰端侧多模态天花板开源

阶跃星辰多模态智能团队开源STEP3-VL-10B多模态模型,仅100亿参数却性能惊人。它采用了独特的架构、训练策略与推理机制,在多任务上表现出色,为小模型发展提供新思路。

AIGC开放社区
新闻资讯8

谷歌新架构突破Transformer超长上下文瓶颈!Hinton灵魂拷问:后悔Open吗?

谷歌在NeurIPS 2025发布两项大模型新架构研究,通过‘测试训练’机制,推理阶段可将上下文窗口扩展至200万token。新成果Titans和MIRAS结合RNN速度与Transformer性能,突破超长上下文瓶颈。

量子位
算法论文8

基于文本AI的终结?Agent协作可直接「复制思维」,Token效率暴涨

在 Agentic AI 代,多智能体系统让 AI 从单打独斗变为团队协作。普林斯顿大学等机构研究者提出多智能体推理框架 LatentMAS,将协作从 token 空间转移到潜在空间,实验显示其性能、效率大幅提升。

机器之心