机器人RL」共找到 1156 篇相关文章

算法论文8

推荐系统进入「双动力」时代!首篇LLM-RL协同推荐综述深度解析

强化学习是推荐系统主流建模范式,但传统 RL 推荐系统有诸多瓶颈。大语言模型崛起带来新机遇,LLM 与 RL 结合开启新范式。研究团队发布首篇相关综述,提出五大协同范式,总结评估体系,分析挑战与方向。

机器之心
新闻资讯7

独家丨小鹏机器人团队“广招兵马”,原字节 Seed 陈杰已加入

AI科技评论独家消息,小鹏机器人团队正招人,原Seed强化学习大佬陈杰已加入。此前鹏行团队规模有过缩减,如今行业竞争加剧,其重又开启招兵买马。小鹏在机器人领域投入已久,何小鹏还表示会继续加大投入。

AI科技评论
算法论文8

RL特训出「押题大师」?破解模型微调中的多样性危机与灾难性遗忘

近年来,基于可验证奖励的强化学习(RLVR)成为提升大语言模型推理能力的重要路径,但许多经RL微调的模型出现‘越训越单一’问题。复旦大学等团队聚焦长期被忽视的KL散度项,提出DPH - RL方法,可缓解多样性坍塌。

新智元
开源动态7

1万4颗星!机械臂可以接大模型了!面向真实世界机器人的尖端人工智能LeRobot

LeRobot 为 PyTorch 中真实世界机器人提供模型、数据集和工具,降低入门门槛。包含尖端方法,已提供预训练模型等,未来将增加真实机器人支持,文中还介绍其安装、使用等内容。

GitHubStore
新闻资讯8

机器狗腿被锯了也能继续走!最新机器人大脑来自320亿估值独角兽

Skild AI推出Skild Brain机器人大脑,它在虚拟环境训练相当于一千年时间成型。此模型没在对应机器人训练,控制能力是涌现的,能应对肢体断裂、马达卡住等情况,还可完成精细动作。

量子位
新闻资讯7

中国机器人这么玩儿,把老外都整不会了

这两天,中国机器人把网上老外看傻眼。松延动力发布小机器人Bumi,售价9998元;本末科技推出全球首款整机模块具身智能机器人D - INFINITE,会功夫。此外,宇树H2等也引关注,中国机器人火出圈。

量子位
算法论文8

EMNLP2025 | SFT与RL的结合,vivo AI Lab提出新的后训练方法

vivo AI Lab 算法团队提出新的大模型后训练框架 GTA,综合 SFT 和 RL 优点,解决文本分类场景中 RL 收敛慢问题。论文已被 EMNLP 2025 录用,介绍了 GTA 框架设计思路、实验结果等,未来还将探索更多场景和大模型。

机器之心
产品应用7

500万次围观,1X把「世界模型」真正用在了机器人NEO身上

1X公司为机器人NEO引入1X World Model,使其学会‘想象’。该模型借助视频预训练,不依赖大规模机器人数据和遥操作演示,能泛化到新场景。实验显示其在多任务上表现不错,但精细操作有挑战。

机器之心
新闻资讯8

独家对话Sharpa核心团队:如何把人类的“触觉”装进机器人的身体|甲子光年

甲子光年对话Sharpa核心团队,该团队定位是以触觉AI驱动的全栈灵巧机器人公司。团队认为触觉是机器人灵巧操作关键,介绍CraftNet创新,还提及与英伟达合作及公司运营、商业计划等。

甲子光年
新闻资讯8

从刮胡子机器人到双臂神技!这家具身独角兽引爆亿级美元融资热潮

具身智能大热,Generalist AI展示「拂晓」仿人自适应机器人完成高难度任务。日前,非夕科技宣布完成C轮亿级美元融资。该公司由前DeepMind科学家创立,获英伟达投资,其机器人在多领域有应用。

新智元