产品应用8
百度 TURA 架构让 AI 检索“动”起来
CourseAI
AI 摘要
传统 RAG 只能读取静态网页,无法满足实时数据需求。百度 TURA 架构分检索、规划、执行三阶段,用工具调用将 RAG 升级,在百度亿级流量场景跑通,树立对话式搜索新范式。
阅读原文 · CourseAI
百度 TURA 三阶段架构:让 AI 检索 “动” 起来
现有检索增强生成(RAG)系统只能读取已索引的静态网页,无法满足用户实时数据需求。百度 TURA 架构用工具调用将 RAG 升级为动态交互,分检索、规划、执行三阶段,已在百度亿级流量场景跑通。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
推荐文章7
LLM Wiki 工程实践与 RAG 融合应用
文章介绍 LLM Wiki 工程实践。包括为 AI Coding 创建知识地图,指导 Agent 加载上下文;在 Obsidian 构建知识体系,有插件和自定义 Agent 两种方法;还分析其与 RAG 关系,指出可融合互补,不要过度神话 LLM Wiki。
AI大模型应用实践
推荐文章7
从 LLM Wiki 到 Google OKF 重建知识底座
文章深入解读 LLM Wiki 与 Google OKF,探讨如何重建企业 Agent 可靠知识底座。指出 RAG 检索有局限,Wiki 式体系可整理知识。介绍 LLM Wiki 构想、OKF 规范及构建符合 OKF 约定的 LLM Wiki 的方法。
AI大模型应用实践
开源动态8
LMCache:解决AI token重复计算难题
斯坦福研究显示,AI Agent每次调用62%内容重复,现有前缀缓存虽有优化但天花板低,阿里云数据表明多数缓存块利用率低。LMCache将缓存管理独立,解决性能问题,其CacheBlend技术复用缓存,适配多引擎和存储后端。
AI工程化
算法论文8
MCompassRAG:用指南针破解RAG检索难题
RAG系统存在chunk切分难题,现有方案有额外成本。MCompassRAG不切细、不rerank,给粗chunk加主题元数据当指南针,训练推理分离,实验显示信息效率提升、延迟降低。
PaperAgent