「机器人学习」共找到 2174 篇相关文章
LLM学习笔记:最好的学习方法是带着问题去寻找答案
文章总结拓展Andrej Karpathy教学视频,分析大模型聊天流程与原理,介绍LLM训练步骤,包括预训练、后训练和强化学习,还提及主流特性应用,如文件上传、网络搜索,强调带问题学习的重要性。
AI大模型重塑学习硬件:从工具到伙伴 | 网易有道孟旭
网易有道词典笔产品负责人孟旭在AICon大会分享,以有道AI答疑笔为例,阐述智能学习硬件在大模型催化下从“学习工具”进化为“智能伙伴”,其发展呈“需求牵引 - 技术支撑 - 体验升级”螺旋路径。
全球首款!高性能人形机器人跑跳进入万元机时代
全球首款万元以内高性能人形机器人Bumi登场,能跑会跳还能当编程老师。它由松延动力打造,团队成员多来自清华,此前已有多款硬核机器人产品,Bumi让具身智能走进日常生活。
GAIR Paper 105|离线强化学习新突破——ROMI:破解对抗式模型学习「过保守、训不稳」深层困局|ICLR 2026
本文聚焦基于模型的离线强化学习,指出RAMBO算法存在保守性难控和训练不稳问题。为此提出ROMI方法,引入鲁棒价值感知框架与隐式可微自适应加权机制,在多基准任务上超越基线算法。
强化学习教父重出江湖, 生成式AI的时代要结束了?
新智元报道,强化学习之父Richard Sutton称GenAI时代正结束。他加入ExperienceFlow.AI,要让AI靠「经验」觉醒。该公司定位打造「经验驱动的去中心化超级智能」,认为AI下一阶段应从世界中学习。
Andrej Karpathy回应强化学习之父Sutton最新观点「LLM是“死路一条”」
图灵奖获得者、强化学习之父Richard Sutton认为当前热门的大语言模型是“死路一条”,因其缺乏从实际互动中学习的能力。AI大神Andrej Karpathy认同其批评,认为当前LLM是向现实妥协的产物,还提出了“幽灵”比喻。
RLPT:腾讯混元在预训练数据上实现自主强化学习
腾讯混元团队发布RLPT,是在预训练数据上应用强化学习的方法,可突破大语言模型扩展瓶颈。它能让模型自主学习推理能力,无需人工标注,在Qwen3 - 4B - Base模型实验中性能显著提升。
Karpathy戳破强化学习神话,首提AI复盘式进化!暴力试错将死
AI大神Karpathy发文指出强化学习(RL)有局限,效率随任务时长下降,与人类学习机制差异大。他提出复盘式进化Scaling范式,虽有很多细节待完善,但认为还有更多S型增长曲线待发现。
小鹏IRON“脱皮证非人”、字节豪掷800多亿,人形机器人竞争太激烈啦!
国内人形机器人赛道白热化,小鹏 IRON 步态逼真引争议,字节跳动高薪招聘并拟投巨资开发 AI 芯片。多家企业推出新机器人,大厂纷纷入局。未来,行业发展看法不一。
机器人终于「懂」家务了!伯克利MomaGraph让机器人像人一样做家务
过去家用机器人做家务存在诸多难题,最近加州伯克利和马里兰大学联手推出 MomaGraph 技术。该技术采用「Graph - then - Plan」思路,团队搭建了完整体系,在星动 Q5 上测试效果好,让家用服务机器人迈向实用。