多Agent系统」共找到 6927 篇相关文章

算法论文8

别再用单选评测骗自己了!Amazon新论文揭示了大模型在选题中的3种系统性偏差

Amazon新论文揭示大模型做选题有3种系统性偏差,如选择、数量、猜测偏差。还推出SATA - Bench评测,给出10个测量指标,提出Choice Funnel解码策略,能提升小模型选题正确率。

深度学习自然语言处理
推荐文章8

《动手写AI Agent》50 行代码,你的第一个 Agent

文章教你用50行代码打造能读文件、跑命令、自主决策的AI Agent Ling。介绍用JSON Schema给LLM装工具,通过循环让LLM按需调用工具,还给出运行示例及与Claude Code的对照。

AI Reading Hub
新闻资讯7

首个为手机而生的通用 Agent?!苹果做不到的事,“野路子”智谱抢先实现了

苹果预计 2026 年升级 Siri 实现自主行动,但完整落地的执行型 Agent 未推出。8 月 20 日智谱发布 AutoGLM 2.0,称是全球首个可在手机用的 Agent,开创‘Agent + 云手机 / 云电脑’范式,能代理操作高频应用。

InfoQ
推荐文章7

与三位前沿研究者聊AI Agent:规则、环境与热潮下的真问题|五源小酒馆Vol.31

五源小酒馆对话三位AI Agent前沿研究者,探讨其发展进展、挑战。他们分享对Agent定义、能力边界判断等,提及过去技术突破,如DeepSeek工作,也指出通用Agent瓶颈,探讨未来模型能否提有价值问题等。

五源资本 5Y Capital
开源动态7

卷疯了!这个清华系Agent框架开源后迅速斩获1.9k stars,还要“消灭”Prompt?

随着大模型能力突破,Agent 从概念走向应用。清华系 Agent 框架 Cooragent 开源获 1.9k stars。其创始人王政认为 Agent 框架要适应样需求,解决泛化与精确性平衡等痛点,还分享了对 MCP、框架融合等看法。

InfoQ
开源动态7

一夜狂揽 6k Star,232 个 AI 专家,真疯了!

开源项目 `The Agency (agency-agents)` 增长惊人,单日获 6K+ Stars,十天新增 3.3 万+。它打包开源 232 个 AI Agent 角色、16 个部门,各 Agent 有完整“人格系统”,支持种主流工具,不过 Token 消耗大。

开源先锋
产品应用8

AI学会梦里干活!Claude发布3大进化,Dario:单人公司10亿美金爆发

在 Code with Claude 大会上,Anthropic 为 Claude Managed Agents 上线三项功能。‘做梦’解决记忆退化,成果评估自动检查工作, Agent 协作让复杂任务分工处理。Dario 称 AI 时代单人公司或达 10 亿美金营收。

鲸选AI
推荐文章7

看完 Manus、Cursor 分享后的最大收获:避免 Context 的过度工程化才是关键

上下文工程优化是Agent创业公司新一年竞争重点,其信息质量很大程度决定Agent表现。文章结合Manus、Cursor团队思路,给出做好上下文工程要点,如缩减上下文、搭建工具行动空间、Agent协作等。

Founder Park
开源动态8

真狠!4 万 Star CodeWhale,AI 写代码最怕的是什么????

文章介绍开源的CodeWhale,它是terminal coding agent harness,GitHub超4万Star。它给代码Agent定规则,涵盖身份、证据等原则。支持模型,有任务流程和Agent协作功能,还分析适用人群并给出启动方法。

小华同学ai
新闻资讯8

OpenAI 硬件负责人的闭门分享:硬件的「终点」依旧是智能手机

OpenAI 硬件负责人 Richard Ho 认为真正的限制是整个系统,继续依赖 NVIDIA 硬件路径,无法把模型推到下一个量级,因此 OpenAI 要重新拿回 AI 运行的底层控制权。他指出手机不是为 agent 设计的,未来是云边结合,现有手机系统难满足 AI 时代需求。

Founder Park