具身多模态推理」共找到 2917 篇相关文章

新闻资讯7

从实验室到工厂:身智能如何跨越商业化的“死亡谷”?|甲子引力X

4月28日「AI共潮生——2025甲子引力X科技产业新风向」大会上,五位嘉宾围绕身智能分享见解。当前行业处概念到商用过渡期,梅卡曼德邵天兰等四位机器人领军人物探讨商业化路径,指出需聚焦场景、降成本、强技术可靠性。

甲子光年
算法论文8

14B打败671B!微软rStar2-Agent在数学推理上超过DeepSeek-R1

如今的大语言模型推理能力关键在于测试时扩展,但长思维链有局限。微软研究团队用主动式强化学习探索,成果 rStar2 - Agent 方法训练出 14B 的 rStar2 - Agent - 14B 模型,性能超 671B 的 DeepSeek - R1。

机器之心
算法论文8

美团提出多模态推理新范式:RL+SFT非传统顺序组合突破传统训练瓶颈

美团研究者提出Metis - RISE框架,将RL激励和SFT增强以非传统顺序结合提升多模态大语言模型推理能力。先RL激发潜能,再SFT补齐短板,训练的两模型在OpenCompass榜单成绩优异。

量子位
推荐文章7

新手必看!强化学习入门指南 | 从RLHF、PPO、GRPO到RLVR,最后到训练推理模型

Unsloth团队发布强化学习教程,从吃豆人谈起,介绍RLHF、PPO、GRPO等概念,分享用GRPO训练推理模型技巧。涵盖强化学习基础知识,还给出Unsloth使用GRPO训练模型方法及奖励函数示例。

AINLPer
产品应用8

搜狐架构演进技术实践:我们如何用 MCP Registry 根治 AI Agent 的“千之灾”

本文讲述搜狐团队在构建企业级 AI Agent 时遭遇‘千之灾’,当前路由模型方案引发‘治理噩梦’。后通过研究 MCP Registry 获新思路,设计新架构,构建 PoC 原型,并对混合路由等问题展开思考。

InfoQ
产品应用7

身智能始祖公司”破产后卷土重来,这次团队做了一个会撒娇的毛茸机器人

身智能始祖公司创始人科林·安格尔在公司破产重整后推出新公司 Familiar Machines & Magic,首款产品 Familiar 是仿生宠物机器人,有情感智能,能本地处理信息,团队希望它用于监护老人等场景。

DeepTech深科技
开源动态8

突破全模态AI理解边界:引入上下文强化学习,赋能全模态模型“意图”推理新高度

在多模态大语言模型应用多元的当下,对模型理解人类意图需求迫切。阿里巴巴通义实验室团队推出HumanOmniV2,解决现有推理路径问题,其相关代码等开源,在多基准数据集成果突破性领先。

量子位
开源动态8

性能比肩DeepSeek-R1,MiniMax仅花380万训出推理大模型性价比新王|开源

MiniMax开源推理大模型MiniMax - M1,原生支持100万token输入、8万输出,性能比肩DeepSeek - R1,仅花380万训成。采用Lightning Attention机制与CISPO算法,在多领域表现出色,模型权重可在HuggingFace下载。

量子位
新闻资讯8

72天,从0到千万小时产能,这个身「新锐派」凭什么接管数据赛道?

觅蜂科技成立72天亮出破局方案,推出MEgo系列无本体数据采集硬件,同步发布数据服务平台、治理引擎,启动蜂巢数据共创行动,与多家头部企业合作,欲解决身智能数据难题。

量子位
新闻资讯7

星海图创始人高继扬:身智能三层技术路线,没有捷径可走

星海图在第一届全球开发者大会上,展示了其在身智能领域的战略布局。提出100万小时超高质量真实数据计划,发布新一代VLA基础模型G0.5并开源,还联合发布创业孵化项目「星途计划」,探索三段式商业模式。

量子位