推理密集型信息检索」共找到 2626 篇相关文章

开源动态8

阿里通义开源「推理+搜索」预训练新框架:小模型媲美大模型,多个开放域问答数据集表现显著提升

阿里通义实验室开源通用预训练框架MaskSearch,引入检索增强型掩码预测任务,兼容两种训练方法。实验显示,它在多数据集提升模型性能,小模型能媲美大模型,还验证了训练方式、策略及奖励函数的效果。

量子位
算法论文8

搜索Agent最新高效推理框架:吞吐量翻3倍、延迟降至1/5,还不牺牲答案质量丨南开& UIUC研究

大语言模型驱动的搜索智能体有能力但效率低。南开和UIUC研究人员剖析效率瓶颈,提出SearchAgent-X框架,实现吞吐量提升、延迟降低,且不牺牲答案质量,还揭示AI智能体平衡和等待问题。

量子位
算法论文8

小模型用不好Skill?新范式让模型学会Skill的底层逻辑,3B模型推理token省5倍,性能反超

浙江大学联合美团龙猫团队、清华大学推出SKILL0,提出技能内化思路。它在训练中引入关键机制,让小模型把技能内化到参数里。实验显示,其效果出色,token效率高,为小模型成领域专家提供新方向。

量子位
产品应用8

GPT-5.2全力出击!碾压44类专业工作,实测编程同价位无对手、深度推理封神,但速度太拉胯了

GPT-5.2登场,有即时版、思考版与专业版。它在多方面大幅升级,能碾压44类专业工作。经济性强,编程能力佳但速度慢,还自评‘最优科研模型’,幻觉现象减少。今日起推送,优先面向付费用户。

InfoQ
产品应用8

首款推理具身模型,谷歌DeepMind造!自主理解/规划/执行复杂任务,打破一机一训,还能互相0样本迁移技能

谷歌DeepMind发布新一代通用机器人基座模型Gemini Robotics 1.5系列,由GR 1.5和GR - ER 1.5组成,结合视觉、语言与动作,实现“规划 + 执行”闭环,还提出Motion Transfer机制,能跨机器人迁移技能。

量子位
算法论文8

RL加持的3D生成时代来了!首个「R1 式」文本到3D推理大模型AR3D-R1登场

强化学习首次被系统性拓展到文本到3D生成领域,上海人工智能实验室等机构研究者提出首个强化学习增强的文本到3D自回归模型AR3D - R1,还提出Hi - GRPO范式和MME - 3DR基准,实验显示其性能优异。

机器之心
新闻资讯8

姚班传奇陈立杰入职OpenAI!16岁保送清华,30岁拿下UC伯克利助理教授

最新消息称姚班大神陈立杰加盟OpenAI负责数学推理。他16岁保送清华,30岁成UC伯克利助理教授,长期从事理论计算机科学研究,近期聚焦扩散语言模型。

量子位
新闻资讯7

Claude惊人真相被教授曝光:思考过程加密,给钱也看不到!

Anthropic推出extended thinking,包装成让用户看到思考过程的透明标杆,但实际仅展示部分内容,核心思考被加密。开发者发现异常,密码学教授逆向有发现,这暴露了其透明度悖论和信任问题。

新智元
产品应用7

谷歌放大招!Gemini「吞下」2.5亿地图数据,路痴AI一夜成精

谷歌推出「Grounding with Google Maps」功能,让Gemini接入Google Maps,可调用2.5亿地点信息。本次更新拓展了AI能力边界,适用于多领域,部分Gemini模型支持,还介绍了使用示例。

新智元
新闻资讯8

诺奖获得者Hassabis警告:AlphaGo已觉醒,AGI正接管科研

十年前,AlphaGo击败李世石,让世人看到AI潜力。此后,DeepMind不断推进,其技术从棋盘拓展到科研,如AlphaFold解决蛋白质折叠难题,AlphaProof在数学推理获佳绩,这些成果显示AGI正接管科研。

新智元