具身操作评测」共找到 2039 篇相关文章

算法论文8

Auto-Research「终极大考」:新基准撕下大模型科研伪装

来自多所高校的研究者提出MLS - Bench,用于解决现有Auto - Research评测的归因问题。它含140个真实研究任务,校准受控修改范围,主实验显示当前模型在方法发现上有明显缺口,Auto - Research需更严格评测标准。

机器之心
产品应用8

深谋科技重磅发布真正为人类服务的新一代人形机器人核心技术「声波传感 · 意念控制 · 高精视觉 · 类脑智能」

深谋科技将在2025 WAIC展示陆上身智能人形“美猴王”和空中身智能巨兽“星汉一号”,并发布新一代人形机器人核心技术,包括传感、脑机交互等系统,构建身智能全域系统闭环。

AI科技评论
产品应用8

起猛了,追觅的扫地机、割草机、洗护机器人在CES成精了!

在AI浪潮下,身智能正加速涌入家用场景。追觅在CES带来多款「身智能」产品,如洗护、割草、扫地等机器人,它们能自主决策执行任务,或成身智能家庭化量产进程最快的公司。

量子位
产品应用8

一个模型场景通吃!它石智航AWE3.7的泛化能力有点狠

长期以来,机器人系统多依赖专有模型,场景变化时需重新训练。如今身智能步入下半场,它石智航通用身大模型AWE3.7用同一颗“身大脑”贯通多场景,回应了通用泛化命题。

量子位
开源动态7

18岁华人开源成果,火爆身智能赛道

18岁华人小哥Eddy Xu的初创公司Build AI开源了有史以来最大的人类为中心数据集Egocentric - 10K,含10亿帧画面,规模是同类的100倍,场景扩展至工厂。不过其缺乏多模态信息,且human - centric路线也有局限。

量子位
开源动态8

多模态Deep Research,终于有了「可核验」的评测标准

俄亥俄州立大学与 Amazon Science 等联合发布 MMDR - Bench,将多模态 Deep Research 评估拉到可核验标准。它含 140 个专家任务,覆盖 19 领域,把评估拆成 3 段管线、12 指标,强调过程证据链。

机器之心
产品应用7

腾讯入局身智能,宇树首批用上“大脑”

腾讯在WAIC 2025推出身智能Tarios平台,它模块化提供能力,集成腾讯软件能力。腾讯重申“三不原则”,与众多厂商合作。该平台核心含模型算法与云服务,能为厂商补齐软件能力。

量子位
新闻资讯8

2026身智能数据赛道,卷出了一匹「黑马」

身智能面临数据掣肘的背景下,觅蜂科技宣布2026年4月16日将在上海举办一站式物理AI数据服务平台发布会,展示全栈方案,解决核心痛点,发布会有诸多看点,还将举办高规格圆桌论坛。

机器之心
新闻资讯7

身智能稀缺的数据,可能藏在这个游戏手柄里?

游戏录屏平台Medal掌握的玩家操作记录成机器人模型训练核心数据。其创始人皮姆创办General Intuition获高额融资,该公司用游戏录像预训练动作模型,但也面临数据多元性、任务表现及合作模式等问题。

DeepTech深科技
开源动态8

Google开源Workspace CLI,让AI在终端操作办公全家桶

Google开源Workspace CLI项目,把全套办公工装进命令行。它动态构建命令结构,输出为结构化JSON。内置超100个Agent Skills,支持多MCP客户端,认证灵活,还集成Gemini CLI扩展。

AI工程化