「多Agent协调」共找到 6084 篇相关文章
合成数据>人工数据,绝对性能暴涨超10个点!仅需任务定义,高效微调大模型
为解决基础模型在专业领域表现不佳、依赖人工标注数据的难题,北大、MIT等机构提出「合成数据强化学习」框架。该框架仅需任务定义,能生成合成数据微调模型,在多领域基准上性能提升显著,代码已开源。
深度剖析 MCP SDK 最新版: Streamable HTTP 模式正式发布,为你实测揭秘
MCP SDK 新版本 v1.9.0 发布,新增 streamable HTTP 传输模式。本文对该模式全面剖析与实测,涵盖快速上手、核心参数、session - id 等内容,还介绍开发服务端及多应用实例模式,指出新模灵活性提升但有不足。
AI 能力越来越强,那么它生成的代码,人类还需要去理解吗?
《代码整洁之道》作者罗伯特·C·马丁不逐行看 Agent 代码,设好测试框架通过就行。Notion 工程师 Geoffrey Litt 在会议探讨人类是否需理解代码,多数人认为需要,Litt 分享理解代码方法。
Claude Code与Codex六大组件拆解
文章指出如今如GPT - 5.6等模型的裸能力相近,但装进Claude Code 或 Codex CLI 后表现差距大,原因在于Agent Harness。它将编码智能体拆解为六个核心组件,详细阐述各组件作用与意义。
GAIR Paper 105|离线强化学习新突破——ROMI:破解对抗式模型学习「过保守、训不稳」深层困局|ICLR 2026
本文聚焦基于模型的离线强化学习,指出RAMBO算法存在保守性难控和训练不稳问题。为此提出ROMI方法,引入鲁棒价值感知框架与隐式可微自适应加权机制,在多基准任务上超越基线算法。
全行业的「龙虾热」中,什么是AI Infra下半场的「神之一手」?
OpenClaw爆火,标志AI进入「自主执行时代」,但面临安全、资源利用和并发规模等挑战。腾讯云Agent Runtime为企业级AI智能体打造专业支持,解决状态管理和行为治理难题,还助力MiniMax突破性能瓶颈。
APP 是功能的软件化,Skill 是经验的软件化
文章指出移动互联网时代人类把需求装进 APP,Agent 时代则把经验装进 Skill。当前多数人未充分使用 AI,微信接入 Openclaw推动大众拥抱 AI。Skill 是新旧世界耦合点,还具备进化能力,可形成复利。
清华孙茂松团队 × 深言科技:以解释作为训练信号,让 8B 模型在幻觉检测上反超闭源大模型
大语言模型幻觉问题待解,成本与算力需求攀升。清华孙茂松团队联合深言科技提出FaithLens模型,把幻觉检测提升为整体评估,以解释作为训练信号,8B模型在多任务上超闭源大模型。
真正面向大模型的AI Infra,必须同时懂模型、系统、产业|商汤大装置宣善明@MEET2026
商汤大装置副总裁宣善明在MEET2026大会分享进展,强调大模型时代AI Infra要解决算力高效支撑问题。商汤战略“1+X”,大装置有优势,算电协同成果好,还推动国产化适配,产业落地成果多。
超10万亿Tokens的高质量数据集是怎么炼成的?专访中国电信天翼AI阮宜龙
中国电信天翼AI打造超10万亿Tokens高质量数据集,依托星辰MaaS平台构建“数据—模型—服务”闭环。其与研究院推进技术研发并落地产品,建“三全”星辰大模型体系,还在多行业展现应用价值。