「RL后训练」共找到 3841 篇相关文章
机器人全程自主收拾客厅!390亿美元估值机器人端到端新技能,英伟达持续加注
估值390亿美元、英伟达持续看好的Figure机器人有新进展,能完全自主、端到端全流程整理客厅。背后是其自主研发的具身大脑Helix 02系统,仅补充新数据就能掌握全新任务。
OpenAI连夜爆出GPT-5.4! 紧急上新GPT-5.3反击谷歌, AI爹味治好了
谷歌DeepMind推出Gemini 3.1 Flash - Lite不到2小时,OpenAI上线GPT - 5.3 Instant,不卷跑分,专治「聊天翻车」,幻觉率降27%,写作能力提升,还剧透GPT - 5.4更快到来。
马斯克急了,直播回应一切!xAI全新阵容首曝光,华人联创仅剩一人
马斯克召开全员大会回应xAI高层变动,官宣合并后全新阵容。他还介绍了xAI四大核心板块,强调其发展成果,提及编程变革,宣布X平台开源等,更规划在月球建AI工厂。
对话蚂蚁灵波首席科学家沈宇军:2万小时真机数据,用“慢功夫”做具身智能|甲子光年
蚂蚁灵波首席科学家沈宇军接受专访,称具身智能处于‘GPT - 1时刻’。团队选‘慢’路,积累2万小时真机数据,发布四个具身智能模型并开源。介绍模型架构、优势、问题及未来计划,还谈了开源考量等内容。
谷歌给「AI解数学题」神话降温:能摘低垂果实,但过程依然痛苦
谷歌用Gemini对700个Erdős猜想做攻关实验,推进13个问题。但他们指出,这并不意味着AI能自动做数学研究,其背后核验等成本远超想象,还需警惕‘潜意识抄袭’。
蚂蚁发布全球首个视频-动作世界模型,开源即刷新世界纪录
从Sora惊艳亮相到谷歌开放Genie 3线上体验,世界模型从概念走向交互世界。蚂蚁旗下蚂蚁灵波开源全球首个视频 - 动作世界模型LingBot - VA,可驱动机器人完成复杂操作,解决长时漂移等问题,还提出工程化解法。
100k Star,他们给Clawdbot升级了超级记忆
Clawdbot项目突破100k,后改名moltbot。其原记忆是静态的,此次升级为超级/动态记忆,构建三层记忆系统,让理解力自我更新。还集成Supermemory,有自动回忆等功能,文章给出实施指南。
解决算力瓶颈,给多模态瘦身!Token压缩完整图谱与选型指南
给多模态大模型瘦身是解决算力瓶颈的关键。Token压缩技术可剔除视觉冗余,提升训练与推理效率。北大等团队剖析其全貌,给出完整图谱与选型指南,还揭示了未来演进路径。
多模态大模型中Attention机制暗藏「骗局」,需用一个公式修正丨上大×南开
上海大学曾丹团队研究发现,主流VLM中attention受位置偏置和padding区域异常高attention影响,直接用其进行视觉token剪枝会丢失关键信息。团队用公式对attention去偏,集成到多种剪枝方法,提升了模型性能。
GPT-5.3爆更前夜,全网都被一张图吓到!ChatGPT人格大赏
OpenAI华人研究员Joanne Jang一条推文引发ChatGPT生图玩法热潮,它能根据聊天记录生成反映‘待遇’的自画像。近期ChatGPT记忆功能优化,已向全球Pro和Plus用户推出。还有爆料称GPT - 5.3要来了。