「RAG性能优化」共找到 2987 篇相关文章
如何让Agent更符合预期?基于上下文工程和多智能体构建云小二Aivis的十大实战经验
文章围绕云小二Aivis项目,分析Agent不按预期输出的原因,从预期和技术层面展开。还总结十大优化经验,如清晰预期、精准投喂上下文等,为构建和调优Agent提供参考。
5.8K Star爆火!!在终端里开网页、刷视频、玩游戏,这操作真绝了!
介绍开源工具`term.everything`,它能在终端运行任何GUI应用,像浏览器、游戏等。该项目在GitHub获5.8K star,支持X11和Wayland应用,可远程使用,但画质和性能有局限。
“扁平+拓扑”双索引,85页PDF"秒级"推理,MMRag幻觉率骤降76%
文章聚焦多模态长文档视觉问答,介绍现有LVLM - based和RAG - based技术路线及困境。提出MMRAG - DocQA方案,引入‘分层索引 + 多粒度检索’,设计双索引建模相关性与依赖,用互补策略实现证据互补。
GPT-5 Pro独立做数学研究!读论文后给出更精确边界,OpenAI总裁:这是生命迹象
OpenAI研究人员喂给GPT - 5 Pro一篇凸优化问题论文,它读完给出更精确边界及证明。虽成果被人类论文反超,但思路不同,显示其有独立探索能力,OpenAI总裁称这是“生命迹象”。
一文读懂:数据中心“拥抱”ARM架构,为何如此艰难?
文章探讨企业数据中心采用ARM架构面临的难题。如现有x86架构主导,切换有兼容性问题;ARM硬件选择有限、性能不足;云服务功能难对等;软件支持和许可证问题也阻碍其应用。
字节真的要干生态了?Coze竟然开源了
字节开源 Coze Studio 和 Coze Loop,此时 Dify 等已在 Agent 基础设施赛道站稳。Coze Studio 提供 AI Agent 开发环境,Coze Loop 负责优化平台,技术栈扎实。开源版功能有删减,字节野心是抢占生态范式。
附部署代码|云数据库RDS 全托管 Supabase服务:小白轻松搞定开发AI应用!
本文展示借助 RDS Supabase 搭建 AI 应用的全流程,对比传统开发,其在效率、成本、扩展性上优势显著。介绍 Supabase 特性、适用场景、核心能力,还给出基于它开发简易 Agentic RAG 应用的步骤。
ParScale:一种全新的大模型Scaling Law
文章提出并行扩展(ParScale)路线,在不增模型参数下,通过引入并行流提升性能。新扩展定律打破传统范式,两阶段后训练策略降成本,还适用于边缘设备,研究仍在进行。
The Batch: 968 | Muse Code 想获取你的数据
Meta推出Muse Code编码框架及Muse Spark 1.2模型,有不同输入输出、功能和性能表现。提供不同档位价格,贡献者档位低价但数据用于训练。测试显示其单任务成本低,Meta此举或为获取编码训练数据。
构建 AI 时代的知识底座:直播数据 LLM Wiki 实践
文章围绕直播数据 LLM Wiki 实践展开,指出领域知识沉淀面临挑战,引出 LLM Wiki。介绍其实际效果,如指标召回、代码生成等,阐述构建方法、架构设计、编译流水线、检索方式,还提及增量编译与持续 Lint,最后给出未来规划。