具身多模态推理」共找到 2941 篇相关文章

算法论文8

快手&中科院 | 提出多模态奖励模型:R1-Reward,比SOTA模型提升5%-15%!

多模态奖励模型对提升多模态大语言模型表现至关重要,但现有强化学习算法用于训练存在问题。快手、中科院等团队提出 R1 - Reward,在基准上比 SOTA 提升 5% - 15%,还在快手业务场景成功应用。

AINLPer
新闻资讯8

多模态技术爆发元年,行业应用如何落地?

InfoQ《极客有约》X AICon 直播栏目,邀上海交大赵波、快手高欢、腾讯邵帅探讨多模态大模型。谈及技术挑战、开源闭源、行业落地等,还分享精彩观点,如先大后小蒸馏提效,垂直模型现阶段更优。

AI前线
算法论文9

复杂的Harness Evolution,甚至不如多跑几遍

本文解读AI2与华盛顿大学最新研究,针对热门Agent Harness Evolution方向,通过公平对照实验检验方法真实收益,戳破研究误区,引发对Agent评估标准的反思。

机器之心
算法论文9

从自己出题到自己选题:耶鲁新方法让大模型 Self-Evolution 又进一步

本文解读了耶鲁、斯坦福等多机构联合提出的INFUSER大模型自进化新方法,针对现有方法仅以难度筛选训练数据的缺陷,提出用影响力分数筛选高价值训练题,实现双模型协同动态进化,实验验证效果显著。

深度学习自然语言处理
新闻资讯7

独家|清华团队组团创业,押注机器人端侧自进化,已完成首轮融资

过去一个多月,机器人学习风向生变。清华李健雄团队围绕机器人学习等研究多年后成立本溯智能创业。他们认为当下主流技术路线有问题,押注In - Context Learning,让机器人端侧自进化,降低部署成本。

DeepTech深科技
新闻资讯8

李飞飞发布:全球首个多模态世界模型

李飞飞团队的World Labs发布全球首个多模态世界模型Atlas,是多模态自回归扩散Transformer,能相机控制生成、3D重建等,已向部分伙伴开放早期访问,未来将成底层模型。

量子位
新闻资讯8

斯坦福吴佳俊「计算机与思想奖」获奖演讲全文:从一张照片,逆推一个世界|IJCAI 2026

8月20日,斯坦福大学吴佳俊在IJCAI 2026发表“计算机与思想奖”获奖演讲。他指出像素是表象,物理结构才是因果,提出以物理代码为桥,融合基础模型泛化力与物理模拟因果性,构建视觉与物理智能。

AI科技评论
开源动态8

机器人也有“Aha Moment”!Zetta ζ 闭环物理智能体在线学习

端到端策略模型在物理世界失灵,现有在线学习路径未走通。清华 AIR 与域变换联合推出 Zetta ζ,通过三个闭环实现闭环物理智能体在线学习,实验显示其任务成功率高,还让机器人出现‘Aha Moment’。

机器之心
产品应用8

第九章 编码 Agent 实战——用 Deep Agents 构建代码审查助手

文章围绕用 `deepagents` 框架构建代码审查 Agent 展开。介绍 `deepagents` 核心能力、安装配置,给出最小可运行示例。还阐述自定义工及使用方法,添加审查 Skill 明确审查标准和流程。

CourseAI
新闻资讯7

Mythos限测首日破防,论坛玩家猜网址就摸进门了

4月7日,Anthropic新模型Claude Mythos Preview限量发布,当天就有未授权用户猜出在线地址获得访问权限。Anthropic称未发现自身系统受影响,该模型对齐表现较好,但训练有技术错误。

新智元