检索上下文劫持」共找到 885 篇相关文章

开源动态8

深度解析 OpenClaw 在 Prompt / Context / Harness 三个维度中的设计哲学与实践

文章从Prompt、Context和Harness三个维度解析OpenClaw设计思路。Prompt工程有动态组装与文件驱动特点;Context工程含可扩展技能、上下文压缩修剪及双层记忆管理;Harness工程为模型套“马具”,保障其可控运行。

阿里云开发者
开源动态8

你花80%精力调的AI,效果被 PDF 解析卡死了

做RAG时,花80%精力优化embedding和检索,效果上限却被PDF解析卡死。OpenDataLoader PDF靠不同架构在基准测试获第一,采用混合架构,还做了三件其他解析器不做的事,思路值得学习。

CourseAI
产品应用8

SDD-RIPER 团队落地指南:如何让整个团队在一周内跑通大模型编程

文章提供了 SDD - RIPER 团队落地方案,能让团队一周内跑通大模型编程,质量可控、效果可量化。阐述了推不动大模型编程的痛点及 SDD - RIPER 的解决办法,介绍了部署、实操流程和试点 SOP,还给出效果数据与常见问题解答。

阿里云开发者
推荐文章7

自动驾驶优化:从复杂性到实时工程

本文深入探讨自动驾驶技术栈端到端架构,阐释从上下文感知传感器融合到MPC求解器等优化技术,如何将原始传感器数据转化为安全控制指令,还介绍轨迹规划、实时计算预算及调试等内容。

InfoQ
开源动态8

AI记忆革命爆发!Clawdbot如何像大脑般记住一切

2026年初开源个人AI助手Clawdbot引爆社区。它可本地运行、集成聊天平台、自主处理任务,有长时记忆和任务执行能力。AI研究工程师Manthan Gupta复盘其记忆机制原理,涉及上下文、记忆存储、搜索等内容。

新智元
算法论文8

让Agent画思维导图稳固长期记忆:新框架实现稳定长期学习,准确率提升38%

中国电信人工智能研究院研究团队提出TeleMem框架,从数据结构层重新设计Agent记忆组织方式,使记忆可检索、累积、回溯和演化。该框架解决了传统RAG在长期记忆管理和持续学习方面的瓶颈,准确率提升38%。

量子位
算法论文8

不止于量化:最新综述用「时-空-构」三维视角解构KV Cache系统级优化

随着LLM向1M上下文演进,KV cache成推理服务效率核心瓶颈。墨尔本大学和华中科技大学研究者发布深度综述,用「时间 - 空间 - 结构」视角梳理KV cache优化方法,还归纳关键观察、提出开放挑战,并整理了资源库。

机器之心
算法论文8

告别「盲目自信」,CCD:扩散语言模型推理新SOTA

华为小艺香港团队等研究人员提出上下文一致性解码算法(CCD)。它解决传统DLM推理“短视”和采样预算固化问题,在开源DLMs上实现3.48倍加速和3.9%性能提升,适配多种解码设定。

机器之心
算法论文8

谷歌DeepMind团队新框架:让AI告别每次从头开始,在任务流中越用越聪明

谷歌DeepMind团队联合伊利诺伊大学提出Evo-Memory框架和ReMem架构,改变大模型只能被动检索历史的现状,让智能体实现终身学习。通过基准测试验证其有效性,实验显示ReMem优势明显,还揭示记忆复用关键因素。

AIGC开放社区
算法论文8

LightMem用3招重新设计了LLM的记忆,结果出乎意料

LLM在超长多轮对话中有上下文窗口有限、记忆系统昂贵的痛点。LightMem借鉴人类记忆机制,用三招重新设计LLM记忆,实验显示其准确率超基线,还降低token使用量、API调用和运行时间。

PaperAgent