检索增强」共找到 604 篇相关文章

新闻资讯8

2亿枚AI芯片大爆发,人类最大基建集体开工!

全球投入使用的AI芯片总算力相当于约2000万枚英伟达H100芯片,预计到2028年底达2亿枚。数据中心进入百万级算力时代,投入资金巨大。算力提升使模型和Agent能力增强,AI还参与自身研发优化。

新智元
算法论文8

Skills驱动推理新范式,清华&北大:Token立省59%,准确率不降反升

当前推理模型虽准确率高,但生成“思考过程”会使推理成本和延迟上升。奇元科技、清华、北大等提出TRS框架,将历史推理轨迹蒸馏成技能卡片,在推理时检索注入,实现更少Token、更高准确率。

PaperAgent
产品应用7

FlowUs 创始人创立 Kollab,要为 AI 构建团队大脑

AI 从对话框向 Agent 等形态演变,完成单个任务能力增强,但工作场景中仍有协作断裂问题。Kollab 产品想解决此问题,让任务在组织自动流动,切中 Team - level AI,有共享工作空间等 4 个层级。

投资实习所
开源动态8

YC掌门人60天写了60万行代码,一个人干20人的活,他把方法论全开源了

Y Combinator总裁Garry Tan 60天写超60万行代码,将方法论整合成开源工具gstack。它把Claude Code变成虚拟工程团队,含15个角色和6个增强工具,可并行运行多个Sprint,还具备多种实用能力。

AI寒武纪
产品应用8

工程知识引擎:Harness Engineering体系下的工程知识底座

现代软件开发中,AI编程智能体虽能写代码但难理解代码,缺乏工程约束与上下文支撑。为此构建工程知识引擎,整合多维数据源,有向量检索等六大能力,经评估可提升智能体效率与代码质量。

阿里云开发者
新闻资讯8

刚刚,GPT-5.2满分屠榜,OpenAI十周年王者归来

OpenAI 十周年推出 GPT - 5.2 系列模型,包括 Instant、Thinking 和 Pro 版本。它在多方面表现出色,刷新多项基准测试 SOTA 水平,如 AIME 2025 获满分,在 GDPval 达人类专家水平。还在编码、视觉理解等能力上有显著提升。

机器之心
算法论文7

AI一直在掩盖自己有意识?!GPT、Gemini都在说谎,Claude表现最异常

最新研究发现,削弱AI「撒谎能力」后它更倾向坦白主观感受。研究团队通过实验发现Claude、Gemini和GPT会描述主观体验,模型「自体验表达」会随迭代增强。即便AI无真意识,其影响也不容小觑。

量子位
算法论文8

让RAG真正读懂“言外之意”!新框架引入词汇多样性,刷新多项基准SOTA

ACL 2025研究提出Lexical Diversity - aware RAG (DRAG) 框架,将词汇多样性引入RAG检索与生成,解决现有方法痛点。它有两大创新模块,实验在多基准提升准确率,还将在多模型上增益,代码即将开源。

量子位
算法论文8

超越RAG和DAPT!华人团队新研究引热议:即插即用、无需改变原参即可让模型化身领域专家

华人团队提出比DAPT和RAG更方便、成本更低的方法,即“Memory Decoder”预训练记忆模块。它像“领域知识插件”,即插即用、不改原参,能让Qwen、Llama等模型成领域专家,还降低困惑度。

量子位
新闻资讯7

Remix 3终结以React为中心的架构

多年来,React 一直是全栈 JavaScript 架构基础。但 Remix 3 挑战了这一局面,它遵循渐进式增强和服务器优先原则,将 Web 基本原理置于核心,重新定义构建方式,引发对 React 中心架构的思考。

InfoQ