「具身鸿沟」共找到 1089 篇相关文章
模仿学习新范式!Chain-of-Action:轨迹自回归实现动作推理
具身智能领域尚未迎来「GPT时刻」,现有模仿学习范式有缺陷。字节跳动与阿德莱德大学研究者提出「动作链」(CoA)策略,通过轨迹自回归建模解决累计误差,提升泛化性,实验效果显著。
CVPR 2025 Tutorial:从视频生成到世界模型 | MMLab@NTU团队&快手可灵等联合呈现
图像生成普及,视频生成也有高质量发展,可灵、Sora等模型不断拓宽边界。CVPR 2025 Tutorial将探讨视频生成能否成世界模型桥梁、具身智能核心能力等问题,汇聚一线研究者分享。
刚刚,HiDream-O1-World首秀登顶,原生全模态UiT架构打造「可交互时代」
过去三年,AI 内容生成行业虽有技术迭代,但用户与模型交互仍单向。智象未来发布全球首款原生全模态交互式世界模型 HiDream - O1 - World,它基于 UiT 架构,在评测中表现出色,解决两大行业难题,应用前景广。
没等VC下场,机器人厂商们先投了一家数据公司
2026年具身智能市场火热,智域基石获灵初智能等四家企业数千万元天使轮融资。其定位第三方数据公司,核心团队背景互补,明确不做本体、模型等四件事,还构建自动化编译管线处理数据。
统一VLA范式!港科大开源StarVLA乐高式架构,复现成本大幅降低
当前具身智能的VLA赛道陷入「碎片化」泥潭,方法难对比、复现成本高。港科大开源StarVLA,提出「乐高式」统一架构,构建模块化开源底座,实现双向模块化,还支持多种训练范式,打通Sim2Real。
5Y News|地瓜机器人完成1.2亿美元B1轮融资
日前,地瓜机器人宣布完成1.2亿美元B1轮融资,A、B轮融资总额达2.2亿美元。本轮融资汇聚多方资本,将支撑其全栈技术研发与产品迭代。它构建完善产品体系,与头部客户合作成果丰硕,还和地平线深度合作。
GPT-5.4发布,最适合OpenClaw的天选模型登场了。
GPT-5.4发布,作者认为它是OpenClaw天选模型。此前Claude贵且受限,GPT-5.3-Codex世界知识差。GPT-5.4代码能力强、世界知识优,还具多特性,如大上下文窗口,目前ChatGPT已上线。
魔法原子迎来“春晚时刻”|甲子光年
2026年,魔法原子成春晚智能机器人战略合作伙伴,还举办全球合作伙伴大会。其自研机器人挑战春晚复杂环境,此前全栈自研积累实力,有超亿元订单,靠场景和生态赋能突围,未来需转化技术优势为商业成功。
2026年OpenAI最看好的3个方向
OpenAI首席财务官与投资人聊2026年AI趋势,涉及多智能体登场、算力换收入、大模型能力突破等。还谈到对医疗、具身智能行业变革影响,破除AI泡沫说法,预测机器人行业前景等。
视频模型也能推理,Sora2推理能力超过GPT-5
DeepWisdom团队研究发现视频生成模型能推理,在空间类任务上比图文模型更擅长。团队推出VR - Bench基准测试,构建客观评分体系。实验显示视频模型在空间推理有优势,相关代码和数据集已开源。