VLA具身模型」共找到 8092 篇相关文章

算法论文8

斯坦福、英伟达和伯克利提出身Test-Time Scaling Law

斯坦福、英伟达和伯克利团队提出身Test - Time Scaling Law。研究发现推理时增加计算量可提升VLA模型性能,揭示动作误差与采样数量幂律关系,还探讨关键问题,给出方法,实验证明结合RoboMonkey能显著提升性能。

机器之心
新闻资讯8

银河通用完成25亿元新一轮融资,身智能“头号玩家”现身|甲子光年

2026年初身智能公司融资热起,银河通用完成25亿元新一轮融资,估值超200亿。其自主研发身智能数据体系与大模型,春晚亮相后产品畅销,在工业和服务端均有成果,身智能迈向产业化。

甲子光年
开源动态8

机器人视觉语言导航进入R1时代!港大联合上海AI Lab提出全新身智能框架

香港大学与上海AI Lab联合提出VLN - R1,可将自然语言指令转化为连续导航动作,打破传统链条。它有两阶段训练等创新支柱,在测试中表现出色,小模型性能佳,推动身智能从数字向身认知跨越。

量子位
产品应用8

谷歌发布本地身智能模型!全程无联网执行精细操作,从人形机器人到工业机器人全覆盖

Google DeepMind团队发布可本地运行的视觉 - 语言 - 动作模型Gemini Robotics On - Device,它能离线运行,操作能力强,可在多种机器人本体部署,解决网络问题,性能、适应能力出色,还开放了SDK。

量子位
新闻资讯7

智元启动「买买买」,路径未明,资本抢跑,主流技术范式下谁在领跑身智能赛道?

2025年7月,智元机器人21亿现金收购上纬新材,成A股首个“身智能概念”上市公司,引发行业震动。身智能技术尚在演进,业内从多方向构建系统,主流路径有端到端大模型体系和双系统架构。

机器之心
算法论文8

解码提速15.1倍、多任务性能不降:复旦&引望WAM-Diff2打通自动驾驶VLA自回归—扩散转换

视觉-语言-动作(VLA模型是端到端自动驾驶主流技术,但自回归解码架构有瓶颈。复旦大学与引望智能联合提出WAM-Diff2,实现自回归VLA向离散扩散模型迁移,解码加速15.1倍,多任务性能不降。

机器之心
开源动态8

文心大模型 4.5 系列正式开源,涵盖 10 余款模型

6月30日,百度正式开源文心大模型4.5系列,含10款模型,实现预训练权重和推理代码全开源。可在飞桨星河社区等平台下载,百度实现框架与模型“双层开源”,技术创新多,性能表现优。

AI前线
开源动态8

Dexmal原力灵机开源Dexbotic,基于PyTorch的一站式VLA代码库

Dexmal原力灵机推出基于PyTorch的开源视觉-语言-动作模型VLA)代码库Dexbotic,面向身智能研究者。其架构含三大核心组件,有五大特征,还推出开源硬件,未来将持续投入生态建设。

机器之心
算法论文8

LeCun发布最新世界模型:首次实现16秒连贯场景预测,身智能掌握第一视角!还打脸用了VAE

LeCun团队推出PEVA模型,让身智能体学会人类“预判能力”,首次实现16秒连贯场景预测。它结合结构化动作表示与条件扩散Transformer,用真实数据训练,解决长时序问题,还能筛选最优动作。

量子位
开源动态7

身智能的「ChatGPT时刻」还没到,科沃斯先把机器人拆开了

科沃斯将旗下身智能机器人“八界”开源,成立“八界开源智创空间”,开放从硬件到底层系统的使用权限。该机器人由轮式底盘加机械臂构成,科沃斯董事长钱东奇不看好人形及VLA技术路线。

量子位