「向量检索」共找到 324 篇相关文章
超越RAG,DRAG让LLM准确率飙升45.5%,问题越复杂能力越强
RAG技术虽能让LLM检索资料生成答案,但存在短板,听不懂话里有话。DRAG方法应运而生,有DRA和RSC两大法宝,经对比实验,它在多任务上领先,准确率大幅提升,计算开销小。
南洋理工、北大、上海AI实验室开源长记忆世界模型
目前世界模型模拟方法在维持长期一致性上有挑战,南洋理工大学、北京大学王选计算机技术研究所、上海人工智能实验室联合开源长记忆世界模型WORLDMEM,介绍了其记忆机制、基础架构、训练技术及检索策略等。
多模态长文本理解测评首发:46款模型无一攻克128K难关
香港科大等研究者联合提出MMLongBench,用于评估多模态模型长文本理解能力。它覆盖5大类型任务的16个数据集,对46个模型测试显示,闭源和开源模型在长上下文任务均面临挑战,OCR和跨模态检索能力是瓶颈。
沉默的进化:LatentMAS 如何通过“潜意识通信”重塑多智能体协作?
这是对多智能体协作领域突破性研究的深度解读。论文提出LatentMAS框架,让智能体直接交换“思维向量”,实现“机器心灵感应”,在性能、速度和Token消耗上全方位碾压传统文本交互模式。
全球首款!Claude引发的数据恐慌,被这家中国黑马补上了
威努特作为网络安全公司跨界推出AI桌面助手WinClaw。它能读懂各类文件并进行向量化处理,有多种检索方式,还能跨文档归纳、关系推理。具备安全的三层防护,支持双平台,注册即可用。
让 Claude/Codex/Cursor 少读文件、多懂代码:Serena 体验
Serena是“编码代理工具箱”,能让LLM像IDE一样理解和改代码,有符号级检索等亮点。适合大型代码库任务,10分钟可上手,有多种接入方式,还有提示词模板,能让AI操作更专业。
零基础指南:从 Prompt 到上下文工程构建 AI Agent 【万字长】
作者结合培训经历,系统梳理零基础构建 AI Agent 的学习路径,涵盖结构化提示词工程、上下文工程与知识检索、工具函数设计和 Agent 规划等内容,还介绍各环节方法、策略和实践案例。
基于 Elasticsearch 创建企业 AI 搜索应用实践
Elastic 中国社区首席布道师刘晓国,分享基于 Elasticsearch 创建企业 AI 搜索应用实践,介绍其向量搜索技术及 RAG 应用开发,还提及智能时代搜索需求变化、混合搜索优势及 Elasticsearch 优化改进等内容。
PolarDB Supabase Edge Functions - 让函数,随时可用
文章介绍 PolarDB Supabase Edge Functions,它是为全栈应用打造的边缘计算方案。提供 CLI 和 Studio 两种开发方式,补全开源版缺失的管理后台,让企业能兼顾功能与控制力,还提及数据库原生多模态智能检索方案。
360 如何用 AutoMQ 解决千亿级 Kafka 冷读难题
360 集团作为互联网安全公司,业务数据规模膨胀,Kafka 集群运维难题凸显。AutoMQ 存算分离等特性适配 360 需求,360 验证其性能后用于日志检索平台,解决冷读难题,未来将推广到更多业务线。