「开放世界智能体」共找到 4378 篇相关文章
世界模型迎来因果升级:CD-LAM仅用几千步微调即可显著增强动作控制
Aether AI与加州大学圣地亚哥分校研究发现现有世界模型会无视动作控制信号,根源是隐动作模型受视觉混杂因素污染。团队提出CD - LAM,从上游净化隐动作表征,实验显示其能降动作误差、提画面质量,降低后训练开销。
Sam Altman最新采访:我们即将破解超级智能,但社会可能依然糟糕,人形机器人是终极梦想
Sam Altman在访谈中分享对未来5到10年AI见解,涉及AI发现新科学、人形机器人、超级智能悖论等,还谈到OpenAI蓝图、能源供应及行业竞争,爆料扎克伯格天价挖人。
智能流体力学专题研讨会特邀报告4|卢臻:基于 Koopman 方法的非线性动力学端到端量子模拟
2026年8月,第十四届全国流体力学学术会议在山东青岛举行,智能流体力学专题研讨会展示了人工智能、机器学习与流体力学交叉领域研究进展。本次分享《基于Koopman方法的非线性动力学端到端量子模拟》报告,团队来自多机构。
星海图创始人高继扬:具身智能三层技术路线,没有捷径可走
星海图在第一届全球开发者大会上,展示了其在具身智能领域的战略布局。提出100万小时超高质量真实数据计划,发布新一代VLA基础模型G0.5并开源,还联合发布创业孵化项目「星途计划」,探索三段式商业模式。
浙大系具身智能再闯港交所:主打工业场景,每天进账1000000元
仙工智能再次冲刺港交所,此前5月首次递表未实质进展。过去三年营收走高,2024年达3.39亿,但连续三年亏损累计1.22亿。其聚焦工业场景,提供机器人控制系统等一站式方案,产品涵盖控制器、软件等。
HyperEyes:从「搜得更深」到「搜得更宽」,并行多模态搜索智能体的效率革命
小红书研究团队提出 HyperEyes 模型,打破现有多模态搜索智能体串行处理模式困局。通过全栈设计实现并行多模态搜索范式跃迁,在多基准测试中表现优异,证明准确率与效率可协同进化。
刚刚,首个空间原生的具身视觉基模开源!机器人更会看我们的世界了
蚂蚁灵波发布并开源了面向机器人真实任务的空间原生视觉基模 LingBot-Vision 及空间感知模型 LingBot-Depth 2.0,能让机器人更精准地感知世界,解决透明反光材质、小目标和远距离目标等视觉难题。
AI进化三年,产业落地真拐点可能就在这场全球顶尖金融智能赛事里
AI发展三年走到关键转向点,应用价值成关键。金融行业是AI应用复杂领域,AFAC2025金融智能创新大赛聚焦解决产业真问题,设百万奖金池,开放多赛道赛题,已开启报名。
ICLR 2026 | LongHorizonUI:让 GUI 智能体不再"半途而废"——面向长链路任务的统一鲁棒自动化框架
近年来,基于多模态大语言模型的GUI智能体在自动化操作上虽有进展,但任务步数超10 - 15步时成功率断崖下跌。研究人员提出LongHorizonUI框架,构建LongGUIBench评测基准,推动GUI自动化在复杂场景落地。
挑战Claude4的8B Agent!NUS提出AgenTracer:面向多智能体系统的失败归因
随着大语言模型发展,多智能体系统潜力大但失败率高。新加坡国立大学等机构研究者提出AgenTracer框架,构建标注管线、设计轻量级追踪器,在失败归因任务上超大型闭源模型,还能助力系统自我提升。