可验证推理」共找到 6048 篇相关文章

算法论文8

Diffusion约2倍无损加速!训练-推理协同的缓存学习框架来了| HKUST&北航&商汤

HKUST、北航与商汤提出HarmoniCa框架,解决Diffusion模型推理慢、成本高问题。它通过SDT和IEPO机制,解决训练 - 推理脱节,在多模型上实现推理提速、质量提升,且训练推理开销低,已开源。

量子位
算法论文8

从显式CoT到隐式CoT:复旦让AI告别啰嗦,实现大模型高效沉默推理

复旦大学等机构团队论文提出SIM - CoT技术,解决隐式思维链推理准确率低、不稳定问题。该技术引入步骤级监督,提升性能、效率和解释性,在多模型和任务测试中表现出色,让大模型高效沉默推理

AIGC开放社区
算法论文8

一句话生成无限逼真3D场景!匹兹堡大学新作直击VLM空间推理软肋丨CVPR'26

VLM在3D空间推理上表现不佳,且缺乏合适测试基准。匹兹堡大学团队提出InfiniBench框架,用LLM Agent迭代优化和聚类策略,按需生成3D场景,还能精准定位大模型空间推理缺陷。

量子位
产品应用8

谷歌Gemini 2.5全线爆发!勇战「濒死恐慌」,却被丝血宝梦吓到当场宕机

谷歌旗舰Gemini 2.5全家桶三款模型昨夜上线,包括正式版2.5 Pro、2.5 Flash及预览版2.5 Flash - Lite。技术报告显示其性能提升显著,还在玩宝梦时惊现类人恐慌,推理性能下降。

新智元
开源动态8

MiroMind新模型超越GPT-5.4,三位顶尖AI科学家加盟

MiroMind发布MiroThinker - v1.7模型家族,在深度研究任务中表现出色,其专有智能体MiroThinker - H1超越多个顶级闭源模型。同时,三位顶尖科学家加盟,分别负责推理模型训练等方向,公司聚焦推理验证性。

AIGC开放社区
新闻资讯8

微软分享三大王炸算法:突破大模型推理瓶颈,性能大涨

今天凌晨微软官网分享三大创新算法,即rStar - Math、LIPS、CPL,助大模型突破推理瓶颈,增强数学推理和思考链能力,还介绍了各算法原理、优势及对应论文地址。

AIGC开放社区
算法论文7

EMNLP 2025 浙大&蚂蚁 | 提出动态压缩CoT推理新方法:LightThinker

随着AI发展,大语言模型处理复杂推理任务能力提升,但推理时产生大量中间步骤和文本,拖慢计算速度、增加资源压力。浙大、蚂蚁等机构研究者提出LightThinker,动态压缩推理步骤,降低内存占用和计算成本。

AINLPer
算法论文8

思维链无限延伸了,MIT等打破大模型上下文天花板

MIT等机构提出新架构Thread Inference Model(TIM),配合专用推理引擎TIMRUN,把推理过程变为树状递归子任务结构并修剪子任务,让模型突破输出窗口限制实现长程推理,实验验证了其性能。

量子位
算法论文8

多模态推理新范式!DiffThinker:用扩散模型「画」出推理和答案

上海人工智能实验室等团队提出全新生成式多模态推理范式,发布模型 DiffThinker。它打破传统定式,以图像到图像生成任务重构推理过程,在多项复杂任务中表现优于顶尖闭源模型,有四大核心特性。

机器之心
开源动态8

AutoDev CLI:打造 AI 生成的 AI Agent 质量保障与验证架构

文章介绍AutoDev CLI,它基于AutoDev MPP架构构建,旨在解决上一代AutoDev智能体测试难题。阐述其起步、迭代、演进、集成过程,实现从AI生成代码到验证、生成测试系统的转变,带来验证演化、移植的优势。

phodal