「通用世界行动模型」共找到 1704 篇相关文章
智能必须基于世界模型?我们和蚂蚁灵波团队聊了聊
上周图灵奖得主 Yann LeCun 认为真正的智能应能在脑海推演,而大语言模型难以触及真实世界。2026 年初,蚂蚁灵波连续四天开源四款具身智能模型,探索从物理交互构建智能的新路径。
智元机器人发布并开源首个机器人动作序列驱动的世界模型
近日,智元机器人发布并开源全球首个基于机器人动作序列驱动的具身世界模型 EVAC 及具身世界模型评测基准 EWMBench,构建全新开发范式,打破具身智能演进制约。
彻底改写Transformer!「能量驱动架构」横空出世,通用推理时代要来了?
UIUC、斯坦福与哈佛联合提出全新「能量驱动Transformer(EBT)」架构,打破「前馈即推理」旧范式,以能量最小化模拟人类思维,训练更高效、推理更精准,在多方面超越传统Transformer。
智元机器人发布并开源首个机器人动作序列驱动的世界模型
智元机器人发布并开源全球首个基于机器人动作序列驱动的具身世界模型 EVAC 及具身世界模型评测基准 EWMBench,构建全新开发范式,解决具身智能演进制约,提升策略模型筛选与训练效率。
开源“裸考”真实世界,国产具身智能基座模型拿下全球第二!
国产具身智能基座模型WALL - OSS在RoboChallenge真机评测榜单获全球第二,多个单任务排第一。它是开源模型,开源程度彻底。还介绍其技术突破及团队情况,强调开源对具身智能发展意义重大。
2025年的冬天,上海凭什么被称为“世界具身智能第一战场”?
2025年上海或成“世界具身智能第一战场”。上海构建服务型政府生态,开放场景、平权算力、建设语料、集聚产业。企业完成蜕变,政策催生技术突变,12月12日GDPS大赛将是成果“实弹演习”。
李飞飞最新长文火爆硅谷
AI教母李飞飞发表长文,首次系统性解释空间智能,提出真正具有空间智能的世界模型须具备生成、多模态、交互三个核心能力,还分享World Labs进展及世界模型在多领域的潜力。
告别抽卡、散装工具拼凑!通用AI视频智能体框架UniVA开源
在AI视频创作中,创作者常因频繁切换工具而疲惫。近期多所高校联合开源的UniVA框架,像「AI导演」,能整合视频工具,提供一站式自动化体验,改变「抽卡」式创作,还支持多轮交互等功能。
腾讯提出“我思故我玩”Agent:LLM构建推理与规划世界模型
腾讯与武大联合发表论文提出 CEL 新型 Agent 架构,通过 LLM 驱动两阶段循环实现“思考式学习”。它能填补传统方法短板,在小游戏实验中表现出色,有可解释性等优势,但也有实验环境局限等问题。
从过拟合到通用!ViMoGen开启3D人体动作生成新纪元
随着AIGC爆发,3D人体动作生成领域滞后,现有模型泛化能力有瓶颈。南洋理工大学等机构研究人员提出ViMoGen,从数据、模型、评估三方面重新定义通用动作生成路径,还能赋能具身智能。