VLA具身模型」共找到 8072 篇相关文章

算法论文8

突破视觉-语言-动作模型的瓶颈:QDepth-VLA让机器人拥有更精准的3D空间感知

视觉 - 语言 - 动作模型VLA)在机器人操控领域潜力大,但应对长时序或精细操作任务时性能下降,根源是缺乏三维空间感知与推理能力。中国科学院自动化研究所与灵宝 CASBOT 提出 QDepth - VLA 模型,提升了机器人空间推理与操控精度。

机器之心
开源动态8

银河通用LDA定义全域数据利用范式,跨本体世界动作大模型开启身GPT-2时刻

当下身智能赛道两大流派各有短板,银河通用推出跨本体「隐式世界 - 动作基础模型」LDA - 1B,走自研WAM路线,成果已开源。它打破数据割裂难题,解锁身智能「GPT - 2时刻」,在多方面展现优势。

量子位
算法论文8

南大等8家单位,38页、400+参考文献,物理模拟器与世界模型驱动的机器人身智能综述

当下,身智能成研究热点。南大等8家单位学者撰写综述论文,指出物理模拟器与世界模型融合是实现身智能的潜力路径。论文系统梳理两者协同推动机器人演进全貌,还提出分级标准等内容。

机器之心
算法论文8

AAAI 2026杰出论文奖 | ReconVLA身智能研究首次获得AI顶级会议最佳论文奖

身智能常被视为‘系统工程驱动’研究方向,ReconVLA获AAAI杰出论文奖,是身智能方向首次获AI顶级会议最佳论文。它解决VLA模型关键瓶颈,通过重建式隐式视觉定位机制,实验效果显著。

机器之心
新闻资讯8

专治Demo玩家:「身灵巧操作奥林匹克」大赛三项第一,全被国内这家公司拿下

星动纪元凭借自研VLA身智能模型,在身界灵巧操作奥林匹克Benjie's Olympics大赛中,于翻袜子(银牌难度)、开锁和剥橘子(金牌难度)三项任务上击败技术领先者PI,拿下全球第一,展现全栈技术优势。

机器之心
算法论文8

ICLR 2026|在「想象」中进化的机器人:港科大×字节跳动Seed提出WMPO,在世界模型中进行VLA强化学习

香港科技大学 PEI - Lab 与字节跳动 Seed 团队提出 WMPO 新范式,可让身智能在‘想象中训练’,解决传统 VLA 训练瓶颈,目前论文、代码与模型均已开源。

机器之心
开源动态8

阿里达摩院开源身大脑基模:3B激活参数性能超越72B,转身就忘事的机器人有救了

阿里达摩院开源RynnBrain身大脑基础模型,全系列7个。它是业界首个有 时空记忆的模型,在20项身Benchmark上超顶尖模型小而美优势,训练用自研架构提效,数据丰富,输入输出灵活。

量子位
新闻资讯8

第一视角效率超过真机,深度机智发布全球首个以人类学习范式构建的身基座模型

2026年身智能行业火热,但技术路线不明。深度机智创始人陈凯在中关村论坛发布身智能基座模型PhysBrain 1.0,用千余小时人类第一视角数据超越真机数万小时数据成果,开启身领域‘物理常识’革命。

AI科技评论
开源动态8

腾讯开源三大身基座模型,首席科学家张正友详解“三层脑”如何破解机器人反应慢

WAIC 2026 期间,腾讯开源三款身基座模型。首席科学家张正友称此前用 OpenClaW 调度机器人效果差,后设计 TairosAgent 框架。腾讯将身智能拆成三层,配合身智能体和框架构成完整矩阵,还解决语言信息不足等问题,并在工业和养老场景测试。

InfoQ
新闻资讯8

世界模型来了因果技术标杆!身大脑真要长脑子了

身智能有泛化能力瓶颈,构建‘世界模型’成热门赛道。Aether AI获2000万美元种子轮融资,走因果世界模型路线,创始人黄碧薇认为这是世界模型‘终局形态’,能让机器人理解物理规律。

量子位