具身操作评测」共找到 2033 篇相关文章

推荐文章7

揭秘大模型评测:如何用“说明书”式方法实现业务场景下的精准评估

文章系统性介绍业务场景下大模型评测流程,包括需求分析、评测集设计生成、维度设定、任务执行和报告输出。指出评测挑战,如设计维度和集,还给出评测方法及案例,像蚂蚁评测集、业务自动化评测

阿里云开发者
算法论文8

物理AI的「原生」时刻:原力灵机发布身大模型DM0

主流‘预训练 - 后适配’范式有局限,原力灵机联合阶跃星辰提出身原生 VLA 模型 DM0。它能统一机器人操作与导航,在 RoboChallenge 测试领先,还介绍了架构、训练方法及未来演进方向。

机器之心
产品应用8

RoboScience机器科学发布轮式仿人形通用机器人REX G1,让机器人真正成为新一代身生产力伙伴|甲子光年

8月17日,RoboScience机器科学发布轮式仿人形通用操作机器人REX G1,搭载自研的Visics通用身大模型,面向多场景打造,能完成完整任务闭环。它将移动与操作融合,适应真实环境,强大泛化能力且续航佳。

甲子光年
产品应用7

RoboScience机器科学发布轮式仿人形机器人REX G1,打造新一代身生产力伙伴

8月17日,RoboScience机器科学发布轮式仿人形通用操作机器人REX G1。它搭载自研VLOA架构通用身大模型Visics,面向多场景,能在真实世界完成任务闭环,备多方面优势。

机器之心
新闻资讯8

独家|「中科第五纪」完成数亿元A轮融资,率先开启海外商业落地

AI科技评论独家消息,身智能企业「中科第五纪」近日完成数亿元A轮融资,年内已完成三轮。该公司还收获海外数亿订单。其提出超少样本操作大模型等核心技术,形成完整技术体系。

AI科技评论
新闻资讯8

蚂蚁集团领投,光轮智能20亿美元估值引领全球身数据基础设施|甲子光年

身智能市场逻辑生变,从关注模型和本体转向数据与评测基础设施。光轮智能获蚂蚁集团领投,估值超20亿美元。其构建完整闭环,参与国际标准制定,打造物理AI教育系统,引领产业发展。

甲子光年
算法论文8

RL 将如何提高身大模型 VLA 泛化性?清华大学团队NeurIPS 2025文章分析 RL 与 SFT 泛化性差异

清华大学团队在NeurIPS 2025发表文章,揭示强化学习(RL)提升身大模型VLA泛化能力的优势,对比其与SFT差异,还提出评测基准和训练方法,为VLA训练提供新方向。

机器之心
新闻资讯8

又一华为天才少年入局身创业!用视频生成数据训家用机器人,首个模型登顶身基模榜单

又一华为天才少年周凯文加入身创企诺因智能。该公司成立不到一年,专注ToC家用身智能机器人,用视频生成数据训练模型,其KnowinBrain模型登顶身基模榜单,团队人才密度高。

量子位
开源动态7

HarnessEval 来了!开启 RSI 时代的新评测范式!

过去一年AI进入RSI时代,但评测方式仍停留在过去。MirroS联合多方发布HarnessEval,将Harness引入评测领域,使评测成为备自我进化能力的智能系统,还率先应用于交互式世界模型评测

特工宇宙
推荐文章7

上海交大/上海AI Lab翟广涛:当评测不再重要,AGI就实现了

上海交通大学教授翟广涛认为完美的AI评测体系等同于通用人工智能。当下评测体系存在数据污染、原子化能力评测局限等问题,他主张回归‘以人为本’,团队提出相关框架和技术路径,目标是训评一体。

机器之心