「Agent能力」共找到 5201 篇相关文章
2026 年做搜索就是做 Agent Memory
本文整理自Elastic全球副总裁肖涵演讲,讲述AI搜索发展历程,指出2026年做搜索基本是做智能体记忆。分析智能体记忆痛点、表征、遗忘等问题,介绍Jina AI相关模型,梳理记忆产品分类与工作流,给出行业观点与建议。
Flash-Searcher:Web Agent的并行革命
当下Web智能体用顺序执行链解决复杂任务存在执行和信息利用率低的问题。为此提出Flash - Searcher,以DAG并行执行机制为核心,提升执行吞吐与速度,在多基准上表现优,代码已开源。
告别微调!斯坦福提出Agentic上下文工程
当前微调大语言模型成本高、不灵活,‘上下文适应’方法有短板。斯坦福大学等提出ACE框架,将上下文变为动态‘战术手册’,解决现有问题。论文通过实验验证其在性能、成本和效率上优势,为大模型发展指明新方向。
阿里最新开源王炸Agent!性能全面SOTA!
阿里WebAgent更新频繁,基本一月一版。它是类似DeepResearch的通用智能体,历经WebWalker到WebWatcher多阶段演进,各阶段解决不同问题,如网页导航、自主信息搜集等,还不断优化训练数据生成与处理方式。
Self-Evolving Agents,AI的“自我革命”
LLMs静态性成应用瓶颈,自演化智能体成破局关键。本次分享的综述围绕演化什么、何时演化、如何演化三个核心问题展开,介绍了模型、记忆等方面的演化内容、时机和方式。
Anthropic:这样构建Agent,性能提升90%!
Anthropic分享从0到1构建多智能体DeepResearch系统的方法,该系统是Claude内置Research功能。干货多,涵盖架构设计、Prompt工程等。多智能体性能比单模型高90.2%,但烧钱,适合高价值复杂任务。
Theory of Agent:构造知行合一的智能体
当前AI(如ChatGPT)存在行为随机性、效率黑洞等问题,论文指出AI缺乏认知地基,需明确认知框架。还提出革命性等式“推理 = 行动”,分析了知识与决策边界,给出最优行为四象限,介绍落地路径和未来发展方向。
Claude 这个更新,让模型能力提升10%+!
Claude开放100万上下文长度更新,实际可用空间接近8倍提升。数据显示,上下文越长Claude与其他模型差距越大。API取消溢价,还更新图片/PDF上限、将Adaptive Thinking转正式版。
综述:LLM 驱动AI Agent通信协议与策略
文章指出传统互联网用户完成行程繁琐,而代理互联网可让代理自动完成。随着LLM驱动智能体应用深入,其发展专业化,需多智能体协同,有效通信成关键。介绍了智能体通信定义、分类及多种通信协议。
Strix AI驱动的漏洞动态验证能力分析
传统SAST工具只能发现‘可能有问题的代码’,无法确认漏洞是否可被利用,导致高误报率。Strix采用‘静态分析 + 动态验证’的混合模式,先定位可疑点,再对漏洞进行真实攻击验证,显著降低误报率。