「Agent智能体」共找到 5340 篇相关文章
AI 智能体实践评估:基准、框架与经验总结
文章为将 AI 智能体从原型落地到生产环境的团队提供实用评估框架。指出传统评估不适用于智能体,介绍评估工具,阐述五大评估支柱,还给出基于 Claude 和 LangChain 的评估示例及实践经验。
自我进化Agent综述:通往超级智能的进化之路
当前大型语言模型面对新知识、动态环境时存在固定参数瓶颈,自进化智能体研究应运而生。本论文作为该领域首部系统性综述,提出革命性框架,解析自进化智能体技术脉络与未来挑战。
智能体的尽头是Harness基建!上海交大深度解读Harness
上海交通大学等团队深度拆解智能体技术核心演进逻辑,指出智能体落地关键已转移到外部认知基础设施。阐述记忆、技能、协议与运行环境(Harness)如何重塑概率生成,介绍各模块特点及前沿趋势。
颠覆金融分析!多智能体AI股票分析师震撼登场!
多智能体AI股票分析师登场,由股票分析与报告撰写两智能体组成,通过CrewAI框架协作。用Streamlit构建界面,结合YFinance等获取数据,可30秒内生成含买卖建议报告。
云厂商「进击」 Agent 开发平台
企业级智能体(Agent)市场崛起重构云服务竞争格局,云厂商需提供全栈能力。腾讯云宣布智能体开发平台3.0上线,优图实验室关键技术持续开源。文中还分析企业开发Agent难题及腾讯云应对举措。
DeepMind 最新研究:智能体就是世界模型!
DeepMind研究科学家Jon Richens团队在ICML 2025发表论文,从第一性原理证明智能体就是世界模型,回答了AI界多年的根本问题,还带来多个有趣推论,引发AI社区热烈讨论。
麦肯锡调研了 50 个一线 AI 智能体的项目总结出来的六条经验
麦肯锡调研50个AI智能体真实项目,提炼出开发智能体的6个关键因素,如关注整体流程、明确适用任务、避免制造“AI垃圾”等,助企业从智能体中捕获价值。
给定"标价"的 LLM 智能体,能规划出"最优"路径吗?
在LLM智能体多轮工具使用中,评估成本是难题。来自多所高校的团队推出CostBench基准,围绕旅行规划构建评估环境。评估顶尖模型发现其规划与适应能力有短板,并分析失效根源,还指出下一代智能体演进方向。
北航领衔发布300页代码智能综述:从基础模型到智能体,一次读懂Code LLM全景图
北航领衔联合近30家机构撰写《From Code Foundation Models to Agents and Applications》,系统梳理代码智能领域,串联模型、任务等成完整技术链路,还通过实验等给出实践指南。
Agentic AI的第三种范式来了,16家机构提出「伴身智能体」
16家海内外高校与科研机构的22位研究者提出ComBodied Agents新范式,它围绕人的长期状态与主体性构建。论文给出闭环技术框架与评测标准,还提到研究难点与风险,也为产品实践提供指导。