「任务特化训练」共找到 3641 篇相关文章
想让机器人春晚包饺子?阿里达摩院:别急,先把「大脑」优化一下
阿里达摩院推出 RynnBrain 模型,从底层出发将时空记忆和物理空间推理训进模型,在 16 项具身 Benchmark 上达 SOTA。还开源 7 个模型,解决通用大模型在物理世界的局限,在多项任务表现出色。
腾讯混元最新开源:一套RL框架打通多个模态,庞天宇团队新作
大语言模型的RL技术已成熟,但多模态生成模型的强化学习训练仍“各自为战”,制约AIGC模型能力上限。腾讯混元庞天宇团队开源UniRL框架,打通多模态RL后训练,覆盖多种模型,内置算法与奖励组件。
阿里QwenLong-32B:1W+超长Token推理,知识密集型复杂文档高效推理
文章介绍阿里QwenLong - 32B在长文本推理的能力。长文本推理有训练效率低和优化不稳定问题,QWENLONG - L1通过强化学习等解决,还阐述其组件、训练步骤,并给出实战代码及相关链接。
机器人长出800个心眼?阿里达摩院开源具身新大脑,硅谷又坐不住了
2026年具身智能竞争激烈,阿里达摩院开源RynnBrain“具身大脑”。它采用分层架构,在16项评测中超越前沿模型。还介绍了核心技术、训练策略等,且全系列模型、评测基准和代码均开源。
Google 推出超小杯 AI:Gemma 3 270M!可进手机和浏览器
Google发布Gemma 3家族最小版本Gemma 3 270M,2.7亿参数,能耗低,在同规模模型中表现突出。设计理念是“够用就行”,适合特定任务,已在多平台发布,开源策略效果好。
刚刚,1500名作家向 AI 宣战!
1500位作家联名向美国出版商发公开信,要求拒绝AI生成的书籍内容,称创作被AI“偷走”,还指出AI有声书取代人类、耗能大等问题。此前法院裁定用受版权书籍训练AI属合理使用。
AI 浏览器还没捂热,给 Agent 用的浏览器已经来了:Ego Lite
最近出现了给 Agent 用的浏览器 Ego Lite。与给人类用的 AI 浏览器不同,它让浏览器成为 Agent 工作台,有隔离任务空间,不打扰用户,解决了任务和执行环境间的距离问题。
从第一性原理出发的RAG推理新范式来了,蚂蚁DIVER登顶权威基准
当前RAG系统处理多步逻辑推理任务有局限,蚂蚁集团团队提出DIVER框架解决推理密集型检索难题。它将检索任务分四阶段,在BRIGHT榜单领先,行业对比优势明显,医疗应用效果好。
Multi-Agent 的灵活编排之路
文章从Copilot 3.0架构规划模块出发,结合DeepSeek R1强化学习训练实践,探讨多智能体架构下大模型编排智能体解决问题。分析Copilot 2.0局限并介绍3.0升级,指出难点,展示效果对比及解决方案。
全球闲置算力训个模型,性能媲美R1,老黄天塌了!Karpathy曾投资它
全球首个分布式RL训练模型INTELLECT - 2发布,整合闲置算力完成训练,成本降低,性能媲美DeepSeek - R1。其采用分布式异步强化学习范式,团队开源四大关键组件,还获Karpathy等投资,未来有多项计划。