「智能体训练」共找到 5187 篇相关文章
独家丨国内人形机器人首笔千台级商单出现
AI科技评论独家获悉,星尘智能与仙工智能达成人形机器人千台级订单战略合作,今年4季度起部分交付。这是国内人形机器人在工业领域最早一批千台级商单,双方采取‘供应链+产品+渠道’合作。
5Y News|诺亦腾机器人完成Pre-A+轮融资
诺亦腾机器人近日完成Pre - A+轮融资,由启明创投领投,多机构参与或追加投资且超额认购。资金用于具身智能技术研发等,其创始人称是对技术和长期主义的认可,五源合伙人看好其推动具身智能行业发展。
挤不动的世界机器人大会上,自变量秀出了真·通用具身智能
2025世界机器人大会上,自变量机器人展示多项成果。通用轮式双臂机器人“小量”“小白”能完成制作香囊、家务整理等任务;“量子2号”仿人形机器人动作精准自然;其具身智能基座模型WALL - A有强大泛化性。
又一推理新范式:将LLM自身视作「改进操作符」,突破长思维链极限
Meta等机构研究者将LLM视为「思维」改进操作符,探究并行 - 蒸馏 - 精炼(PDR)推理方法。实验显示,PDR在数学任务中提升准确率,还训练8B模型让推理方法更适配,减少训练与部署的不匹配。
2499 元产品背后:地瓜机器人将智驾 know-how 转为机器人新解法
AI重塑机器人技术边界,具身智能成新战场。地瓜机器人从地平线拆分,将智驾经验用于机器人。它提出大小脑分层架构落地更快,还推出RDK S100套件,搭建具身智能底座应对数据和应用难题。
无需标注和奖励模型!仅靠自信度RL,16个样本训练20步,效果飙升21%!
论文提出RLSC,让大语言模型用自身答案置信度作奖励信号,摆脱人类标注依赖。它以模型自信度内部信号替代多数投票外部信号,小成本提升模型数学能力,还让模型学会快推理,不过也存在安全隐忧。
慕思联手华为鸿蒙,完成一场卧室里的“静默实验”|甲子光年
在AI浪潮下,睡眠场景需“静默革命”。慕思联手华为鸿蒙推出鸿蒙智选慕思智能床Pro H - Design,采用底层代码级深度共研,还自研传感技术与算法,构建闭环服务用户,重写智能床竞争逻辑。
把RoPE扔掉,AI更能看懂长上下文!Transformer作者团队开源大模型预训练新方法
Transformer架构核心作者之一Llion Jones团队开源新技术DroPE,可丢弃位置嵌入扩展上下文,解决RoPE长序列处理缺陷,在多模型实验中表现卓越。该团队来自Sakana AI,此前还有相关研究成果。
英伟达发现RL Scaling!创造力暴涨,做基座模型做不了的事!
过去学界争论强化学习(RL)对语言模型的作用,此前研究认为其效果有限。本文发现问题出在训练时间短,提出ProRL,让训练突破2000步以上,结果惊人,小模型也能有出色表现。
5亿热钱砸向具身智能新玩家!地平线VP创业,余凯又投了
具身智能赛道火热,无界动力获5亿天使轮融资。其创始人张玉峰是前地平线副总裁,团队实力强。此轮融资将加速基础模型研发与专家模型落地,公司首代机器人平台已在两方向突破。