机器人具身推理」共找到 3391 篇相关文章

算法论文8

大模型解数学题是真懂还是 “死记硬背”?|首个反例驱动的数学推理基准揭穿 “刷题式假象”!

随着大语言模型在数学领域应用渐广,其是否真备数学推理能力成焦点。清华等团队提出反例推理评测基准COUNTERMATH,测试20+主流模型,结果不佳,而小样本微调能显著提升模型能力。

深度学习自然语言处理
新闻资讯7

阿里云飞天企业版X平头哥“真武”芯片,推理性能跃迁13倍,底层逻辑是什么?| Q推荐

过去几年,模型虽强但使用成本高,阻碍企业级AI深度应用。今年‘模型推理’成AI关键词,4月13日19:00,InfoQ联合阿里云邀专家围绕推理加速底层破局展开对话,探讨算力博弈、芯片性能跃迁等问题。

InfoQ
新闻资讯8

半年3轮10亿,他们都投了这家已经把机器人卖到500个家庭的公司

未来不远机器人半年获3轮10亿融资,字节跳动等入局。其全产业链闭环强大,展会表现优,已进入500多家庭。靠全栈自研、贴合需求等策略,在赛道脱颖而出,认为家用机器人应重真实落地。

量子位
新闻资讯8

马斯克发布 Grok 4 模型:推理能力较前代提升 10 倍,各学科测试接近满分

xAI 发布 Grok 4 及 Grok 4 Heavy 模型,推理能力较前代提升 10 倍,多测试接近满分。马斯克称其为世界最好 AI。它在多方面表现出色,如长任务能力强、推理效率佳等,但代码能力欠佳,且付费昂贵。后续还将推多款模型。

Founder Park
新闻资讯8

专治Demo玩家:「身灵巧操作奥林匹克」大赛三项第一,全被国内这家公司拿下

星动纪元凭借自研VLA身智能模型,在身界灵巧操作奥林匹克Benjie's Olympics大赛中,于翻袜子(银牌难度)、开锁和剥橘子(金牌难度)三项任务上击败技术领先者PI,拿下全球第一,展现全栈技术优势。

机器之心
新闻资讯8

银河通用完成25亿元新一轮融资,身智能“头号玩家”现身|甲子光年

2026年初身智能公司融资热起,银河通用完成25亿元新一轮融资,估值超200亿。其自主研发身智能数据体系与大模型,春晚亮相后产品畅销,在工业和服务端均有成果,身智能迈向产业化。

甲子光年
算法论文8

清华&Qwen最新论文实证: VLM 智商与机器人操控能力“零相关”

清华和 Qwen 最新论文《VLM4VLA: Revisiting Vision - Language Models in Vision - Language - Action Models》测试 24 个 VLM 模型,构建极简 VLM4VLA 测试,发现 VLM 通用能力与机器人操控能力‘零相关’,还揭示视觉编码器短板。

深度学习自然语言处理
新闻资讯8

寻找最强身大脑!全球机器人顶会ICRA开启报名,智元全程陪跑带你拿奖

由智元主办的AGIBOT WORLD CHALLENGE @ICRA 2026赛事开启报名,设推理 - 操作和世界模型两赛道。智元提供顶配硬件、仿真平台、数据集和基线模型,还有超百万美元奖金与资源,助力开发者。

量子位
算法论文8

开放世界任务成功率82%!美的攻克机器人泛化控制难题

美的AI研究院和华东师范大学联合提出ChatVLA - 2模型,引入动态混合专家架构和双阶段训练流程。真机实验显示其开放世界任务成功率达82%,远超现有方法,为通用机器人控制提供新思路。

量子位
开源动态8

蚂蚁dInfer框架,让扩散大语言模型推理速度再飙10倍,相同模型性能下超越自回归模型

蚂蚁开源dInfer框架,联合名校发论文阐述实现细节。它解决扩散模型推理难题,提出创新算法和系统优化策略,实验显示其推理速度远超Fast - dLLM和自回归模型标杆vLLM,代码已开源。

AIGC开放社区