VLA具身模型」共找到 8070 篇相关文章

开源动态8

中科院联合清华等发布视觉语言行动推理模型VLA-R1,让机器人先思考再行动

中科院自动化所、清华和GigaAI联合发布视觉 - 语言 - 行动模型VLA - R1,让机器人先思考再行动。它通过构建数据集教模型思维链,结合监督微调与强化学习提升性能,经多场景测试表现出色。

AIGC开放社区
推荐文章7

模型遇到的很多问题,在数据采集时就已经注定了丨鹿明联席CTO丁琰分享

身智能创企鹿明机器人联席CTO丁琰,分享身智能数据采集现状、困境及新兴采集方式UMI。他强调模型问题多源于数据采集,还介绍鹿明产品FastUMI Pro,及其数据采集、模型训练生态。

量子位
新闻资讯8

对话八位身智能大咖:模型之争、数据来源与第一性原理|甲子光年

在11月20日智源身OpenDay上,甲子光年创始人张一甲与八位身智能领域核心践行者对话。探讨世界模型、统一架构等问题,指出身智能虽前景好,但面临数据、模型等困境,各方分享应对策略与决策原则。

甲子光年
算法论文8

阿里新研究:统一了VLA和世界模型

阿里达摩院等提出WorldVLA框架,融合视觉语言动作模型与世界模型。它用三套分词器编码,解决传统自回归模型问题,经联合训练,实验显示其性能优,两模型还能相互助力。

量子位
算法论文8

VLA统一架构新突破:自回归世界模型引领身智能

北京智源研究院联合中科院自动化所提出 UniVLA 全新 VLA 模型架构,基于全离散、自回归机制建模多模态信号,后训练引入世界模型。它刷新多项基准纪录,在真机操控和自动驾驶有潜力,为多模态感知决策融合带来新思路。

机器之心
新闻资讯7

Generalist爆火背后:身智能真正的竞争,已不在模型

Generalist AI发布的GEN - 1模型引爆身智能领域,其多项指标出色,预示身智能竞争从模型层转向基础设施层。行业关注焦点转移,数据正从‘静态数据集’演进为‘动态教育系统’,评测与仿真基础设施成关键。

机器之心
开源动态8

小米陈龙团队首作:统一身与自动驾驶的开源模型

小米身智能团队发布首篇论文,提出统一身智能与自动驾驶的新模型MiMo-Embodied。该模型在多任务中领先,其四阶段训练框架打通两领域边界,为行业提供新范式。

AI科技评论
开源动态8

WRC整理床铺机器人背后模型曝光!端到端双系统全身智能VLA,仅凭少量微调就能get任务

星海图在2025WRC展示G0模型,可让机器人自主完成铺床任务。其发布端到端双系统全身智能VLA模型G0,结合真机数据集与架构,还构建开放数据集,评测结果优于π0模型,即将开源。

量子位
新闻资讯8

看完智平方创始人郭彦东的这场演讲,我对 VLA 又有信心了

2026年身智能赛道技术路线引争论,“VLA时代终结”论调扩散。智平方创始人郭彦东演讲回应,称VLA时代未终结,世界模型汇入VLA,关键变量是类脑架构,智平方技术成果和开源平台也证明VLA有生命力。

AI科技评论
开源动态8

一个框架,重塑身研发流程:Dexbotic走向身PyTorch

开源身智能原生框架 Dexbotic 宣布支持 RLinf 作分布式强化学习后端,打通 VLA 模型研发中「SFT 与 RL 割裂」问题。其 2.0 版实现模块化解耦与多源混训,构建开发闭环,孵化出 DM0 大模型

机器之心