「多agent协作」共找到 6233 篇相关文章
Spec 退场,skills 上位:Codex 团队的产品方法论变了
文章介绍了OpenAI Codex团队产品方法论的变化,从重视spec转向skills,开发从“描述过程”转向“组织能力”。还谈及Codex app开发、团队协作等,指出模型变强后工作模式转变,职业边界模糊,团队招人看重主动性。
完全取代Claude Code?OpenAI反击来了,推出Codex app「限时免费使用」
OpenAI推出macOS版Codex应用,反击Claude Code。它有全新交互界面,助开发者管理多AI Agents,支持并行任务。限时内,ChatGPT部分用户可免费使用,速率限制有调整,还具备多种新特性。
全球第一个「无人公司」来了:AI 开公司帮你赚钱,这件事终于有人跑通了
市面上 AI 工具多停留在帮用户做出产品,难以将其运营成生意。Flowith 团队的 Matrix 产品主打用 Agent 开「无人公司」,让 AI 完成调研、生产、发布、获客等工作,有望破局。
腾讯开源智能体构建框架
腾讯开源智能体构建框架 Youtu-Agent,灵活高性能,验证性能出色,开源友好成本低。有自动智能体生成等亮点,适用于不同用户群体,涵盖研究、开发等场景,还介绍核心概念,附项目地址。
Karpathy组建大模型「议会」,GPT-5.1、Gemini 3 Pro等化身最强智囊团
前OpenAI联合创始人Andrej Karpathy发推称养成用LLM阅读习惯,还做了个新项目,让四个最新大模型组成LLM议会当智囊团。项目是Web应用,提问后多模型处理,有互评和投票机制,已开源。
AI助手现在认路了:谷歌地图直接「长」进大脑
谷歌DeepMind为Gemini API更新,带来三大核心变化:内置工具和自定义函数可在同一次调用混用;新的「上下文环流」技术解决多步骤工作流丢上下文问题;Google Maps原生接入Gemini 3。这让Agent开发走向「工业化」。
让两个大模型「在线吵架」,他们跑通了全网95%科研代码|深势发布Deploy-Master
科学计算领域开源软件多,但多数无法直接运行,制约可用性。Deploy - Master 针对此开发,通过搜索筛选工具、双模型博弈构建,将部署成功率提至 95%以上,为 Agentic Science 提供行动基座。
OpenClaw大考!上海AI Lab InternLM团队WildClawBench 60题,把「龙虾」AI打回原形
上海人工智能实验室InternLM团队推出WildClawBench,含60道高难度任务,在真实OpenClaw环境端到端评测AI Agent。评测涵盖多类别任务,已测14个模型,国产模型表现亮眼,项目开源可复现。
「说 Harness 会被淘汰的,肯定没做过工程」,Kimi 前 CLI 负责人戳破了 AI 圈最大的误解
AI编程圈两极分化,围绕底层Harness是否消失争议不断。前Kimi CLI负责人stdrc提出反常识观点,认为模型越强Harness越厚,复杂度从“能力层”转移到“协作层”,还以Kimi CLI实践及Raft创业为例阐述。
刚刚,Anthropic开源Claude挑战黎曼猜想的4篇论文
Anthropic开源未公开版本Claude挑战黎曼猜想的4篇论文。Claude虽未证出猜想,但将零点在临界线上的比例下界从41.6%推到67.2%。整个过程由多智能体自主完成,还建立严格验证体系。