多Agent系统」共找到 6915 篇相关文章

算法论文7

ICML 2025 Spotlight | 谁导致了智能体系统的失败?首个「自动化失败归因」研究出炉

ICML 2025 Spotlight 论文提出「自动化失败归因」新方向,应对智能体系统失败难诊断问题。构建「Who&When」基准数据集,设计三种初步方法并评估,虽现有方法表现有限,但此研究意义重大,有望助力打造更可靠系统

机器之心
推荐文章8

深度解析 Claude Code 在 Prompt / Context / Harness 的设计与实践

本文深度解析Claude Code在Prompt、Context、Harness三方面的设计与实践。介绍了Prompt动态组装过程,探讨CLAUDE.md项目说明、上下文压缩体系和记忆系统,还阐述了系统级提醒、Agent及安全体系等内容,文末分享了项目有趣彩蛋。

阿里云开发者
推荐文章8

一文搞懂 Agents 评测丨Anthropic 最新万字长文

传统模型评测方法难评估 Agent 系统,Anthropic 摸索出有效评测设计方法。文章介绍评测结构、意义、方法,涵盖编程、对话等 Agent 评测,还给出打造评测路线图及与其他方法结合的建议。

特工宇宙
推荐文章8

当 Kanban 不再管理人:Routa Kanban 如何管理 Agent Team

本文探讨了 Routa Kanban 如何管理 Agent Team,指出在 AI4SE 时代, Agent 协作进入日常软件交付需建设管理界面与工程护栏。Routa Kanban 把 Agent 协作推进到‘管理驱动’,其价值在于将隐性约束显性化。

phodal
推荐文章8

评论送书 | Code Agent实战案例——用Pywen Agent、Claude Agent和Codex Agent从零开始构建一款网页游戏

本文展示用三大Code Agent依斯特鲁普效应构建网页游戏,对比其表现,还介绍让AI做测试方案、写文档,体现Code Agent在快速原型开发全生命周期的应用,还推荐相关书籍解答不同人群疑问。

AIGC开放社区
开源动态8

上百个Agent,该怎么管?清华团队新思路:重做Session

Agent数量增,管理难题凸显。清华与中大团队开源OpenRath,以Session为核心,让Agent共享状态。它借鉴PyTorch,解决了证据存储、状态流动等问题,使Agent集群管理更高效。

新智元
推荐文章8

智能体在「燃烧」Token!Anthropic公开发现的一切

Anthropic发布智能体研究系统构建解释,解决智能体研究困惑。智能体系统优势明显,在特定任务中表现出色,但token消耗大。其架构独特,还介绍了提示词工程、评估方法、面临的工程挑战等内容。

机器之心
开源动态8

轻量级开源AI智能体框架!智能路由+上下文管理,前后端接口支持!

随着智能体系统成对话式AI新趋势,GitHub现轻量级高灵活性AI智能体协调框架Agent - Squad,它能实现智能体协作、路由和上下文共享,支持双语言,部署灵活,功能强大且安装友好。

开源星探
推荐文章7

MiniMax 怎么做 Agent:Model-Harness 协同只是第一步,还有 Inference-Harness 协同

本文介绍了 MiniMax 在 Agent 层面的实践。从内部飞书 bot 起步,发展成桌面应用 MiniMax Code,形成训练 - 服务闭环。还阐述 Agent 对模型优化迭代的作用、自研 Agent 优势,指出 AGI 是闭环递归自我改进系统

Founder Park
产品应用7

LangChain提出Agent工程化的新分层(Agent harness)

LangChain获新融资后重新定位为Agent基础设施提供商,将Agent开发分三层:Framework、Runtime、Harness。Vtrivedy提出Agent Harness概念,强调构建关键是“个性化定制基座”。Agent开发工程化成熟度在提升。

AI工程化