「多阶段推理系统」共找到 4041 篇相关文章
击败Meta登榜首:推理增强的文档排序模型ReasonRank来了
本文第一作者刘文涵聚焦AI搜索研究。提出推理增强的文档排序模型ReasonRank,在多个榜单击败多校和机构登榜首,其7B版本超越32B模型,论文获Huggingface paper日榜第一。还介绍研究动机、方法及实验结果等。
借鉴人脑「海马体-皮层」机制,红熊AI重做了一个「记忆系统」
记忆成AI进化关键,Google Research新论文提出「嵌套学习」范式。红熊AI受业务难题启发,推出「记忆熊」,借鉴人脑机制重构记忆系统,在多场景应用落地,提升了服务质量和效率。
去掉像素中介!上海交大让AI边看边想边画,用同一个“大脑”跨模态推理
上海交大等团队提出LatentUM架构,摒弃像素解码中介,在共享语义潜空间跨模态思考。它用MBAQ技术转化视觉特征,设计MoME架构,还能自我反思、规划路线、模拟世界演变,表现出色。
直播预约 | LightMem:面向大模型的轻量化可插拔记忆系统
本报告聚焦大语言模型长期记忆构建与轻量化机制。现有外部记忆系统有记忆臃肿、组织低效、更新代价高问题。为此提出LightMem架构,能为大模型提供轻量、高效、可扩展记忆组件。
刚刚,OpenAI内部推理模型斩获IOI 2025金牌!所有AI选手中第一
OpenAI内部推理模型获IOI 2025金牌,总排名第6、AI组第1,沿用IMO金牌版本且未专门训练。商业模型在IOI表现不足,Grok 4相对领先。巨头热衷竞赛,源于竞争、技术迭代及多方利益考量。
抢天才还是拼算力?前 Llama 推理负责人详解 AI 的真实天花板
前 Llama 推理负责人 Ross Taylor 在播客访谈中指出,AI 竞赛中的混乱和挖角是噪声,最终会被指数级算力淹没。他阐释了算力指数曲线决定竞赛天花板,强调系统性实验、高质量评估的重要性。
临床PK完胜ChatGPT-5!国内团队造出首个OCT影像AI系统
近日,空军军医大学李妍教授团队与深圳清华大学研究院朱锐团队联合完成的COMPARE研究发表。其构建的CA - GPT系统在PCI决策制定上显著优于ChatGPT - 5,有望重新定义心脏介入手术智能化标准。
小模型推理极限在哪里?微博开源3B小模型,比肩顶级闭源
微博新开源的VibeThinker - 3B小模型,将特定能力维度性能推向极限。它在数学竞赛、编程等可验证推理基准上表现优异,成绩直逼顶尖大模型。其训练流程层层叠加,还提出参数压缩 - 覆盖假说。
Multi-Agent记忆系统MIRIX:比RAG性能飙升35%,存储减少99.9%
现有AI Agent记忆方案有局限,MIRIX作为模块化多智能体记忆系统应运而生。它由六种记忆类型和多智能体框架组成,支持多种检索功能。在多模态和单模态测试中表现优异,为记忆增强型LLM智能体设新标准。
GitHub 1.8W star爆款!不到2M,win系统高级感拉满!
TranslucentTB是为Windows系统设计的开源轻量级工具,主打任务栏透明化。它资源占用低,功能丰富,有多种视觉效果、能智能动态切换等,还提供多种安装渠道。