「重排序器」共找到 1246 篇相关文章
RAG效果不佳?先别急着微调模型,这几个关键节点才是优化重点
文章深入探讨RAG技术实现与优化,指出其在AI应用开发中常被当黑盒,从文档分块、索引增强、编码、混合检索到重排序等关键环节解析,强调结合场景调优以提升召回与精确率。
RAG 2.0 深入解读
文章深入解读RAG 2.0,指出其虽在多行业落地,但面临多模态处理、检索质量等挑战。还介绍架构升级,阐述检索、重排序等关键技术,最后探讨统一多模态大模型、安全等发展方向及挑战。
Anthropic Labs 负责人:AI 时代做产品,最大的陷阱是「做太多」
Anthropic Labs 负责人 Mike Krieger 在播客中探讨 AI 时代产品建造问题。他以重建 Bourbon 为例,指出 AI 加速开发有弊端,还分享产品易过度建设、需接受重写等观点,也谈到团队结构、企业客户矛盾等内容。
Harness 工程实践复盘:100% Cache 命中的 Agent 怎么设计?
本文是 ClackyAI 团队在 Harness 工程实践上的复盘。他们经两代失败后用 Ruby 重写第三代 OpenClacky,总结影响成本和效果的 7 个关键决策,如双 Cache 标记、System Prompt 字节冻结等,凸显 Harness 工程对 Agent 产品的重要性。
源神!Twitter推荐算法被马斯克悄悄开源了
马斯克将X平台(原Twitter)「为你推荐」信息流算法开源,不到一天冲到5000 Star。该算法将站内与站外内容合二为一,用基于Grok的Transformer模型统一排序,移除手工特征与大部分启发式规则。
用户痛点发现器
用户痛点发现器是个Web应用,能从社交媒体自动发现用户核心痛点,支持聚类分析和AI产品方案生成。它可输入关键词抓取抖音视频和评论,用GLM-4.6模型分析,还有优先级评分等系统。
Claude Skills彻底火了,真的比 MCP 简单太多了。
Claude Skills在中文社区火了,它解决重复写提示词、token贵及定制难的痛点,可分层加载给上下文窗口减负。它能与MCP组合,官方开源20多个Skill源码,还代表了Agent能力模块化趋势。
ICML 2026|告别「单线程」思维,智能体进化出了原生的并行推理大脑
北京通用人工智能研究院语言交互实验室提出原生并行推理器NPR,它有「自蒸馏 + 并行强化学习」三阶段训练范式,配套并行推理引擎,让并行推理成模型原生认知能力,还介绍了其具体实现、实验结论等。
小鹏加速冲向L4终局:对VLA架构「动刀」成关键一环
在辅助驾驶领域,端到端的VLA方法虽有效果,但面临中间层语言难以准确表达物理世界细节的问题。小鹏汽车去掉“语言转译”环节,推出第二代VLA,有跨代级驾驶体验,背后是底层技术架构重构。
零Token部署GraphRAG,LinearRAG做到了~
现有GraphRAG模型在实际应用中常不如朴素RAG,原因是自动构建的知识图谱质量不佳。LinearRAG框架通过Tri - Graph架构、两阶段精准检索和零Token范式重构GraphRAG,在多数据集上超越现有方法,代码和数据已开源。