「显式CoT」共找到 85 篇相关文章
首篇潜空间推理综述!模型思考不必依赖Token,带宽暴增2700+倍
史上首篇潜空间推理综述全面总结新兴推理范式,分析循环、递归等推理形式并总结成框架。潜空间推理用潜式思维链,带宽比显式CoT提升2700多倍,还介绍无限深度推理实现途径。
文生图进入R1时代:港中文MMLab发布T2I-R1,让AI绘画“先推理再下笔”
港中文MMLab团队发布首个基于强化学习的推理增强文生图模型T2I - R1。它提出双层级CoT推理框架和BiCoT - GRPO强化学习方法,解决生成评估难题,为多模态生成提供新范式。
刚刚,OpenAI神秘新模型斩获IMO 2025金牌!攻克奥数巅峰,硅谷沸腾
OpenAI用全新通用推理模型夺下IMO 2025金牌,解出5道题狂揽35分,远超此前Gemini 2.5 Pro的13分。此或意味着其研发出颠覆性推理技术,告别CoT,且模型未针对IMO训练,有持久创造性思维。
2025小结:从RL到Agentic RL
作者回顾2025年从RL到Agentic RL的发展,指出Agentic RL存在慢、不稳定、难scale的问题,还探讨了RL与推理、CoT的关系,以及RL的泛化能力,认为RL能提升模型能力但还不稳定,期待明年研究。
邱锡鹏团队新作:让机器人学会「察言观色」
复旦大学邱锡鹏团队等发布全新操作框架 RoboOmni,突破传统 VLA 依赖显式指令局限。它融合多模态信号,构建数据集,在成功率等方面超基线,以跨模态指令让机器人主动推断意图,开启具身智能‘共情时代’。
今天,AI内容新规正式实施,这次不注意是真的会违法。
9月1日,《人工智能生成合成内容标识办法》及配套国标正式执行。其旨在解决AI虚假内容充斥问题,规定AI内容需打显式和隐式标识,对专业环节友好、公开传播严厉,还对相关方提出不同要求。
DeepSeek们越来越聪明,却也越来越不听话了。
论文《When Thinking Fails: The Pitfalls of Reasoning for Instruction - Following in LLMs》用实验验证,模型推理能力变强时,提示词遵循能力变差。研究团队对15个模型测试,发现用CoT推理后执行准确率下降,还提出4种提升指令遵循效果的方案。
昨日,AI内容新规正式实施,这次不注意是真的会违法。
9月1日,《人工智能生成合成内容标识办法》及配套国标正式执行。新规规定AI模型或应用提供方要给生成内容打“显式”与“隐式”标识,对产品创业者、AI工具提供方和创作者等提出不同要求。
最鲁棒的MLLM!港科大开源「退化感知推理新范式」 | AAAI'26
多模态大语言模型(MLLMs)在真实世界视觉退化下性能崩溃,制约产业落地。港科大等团队开源的Robust - R1被AAAI 2026接收为Oral,提出显式结构化推理新范式,实现质量与鲁棒性双重突破。
小米MiMo Agent 跨会话进化
多数AI编程Agent任务一长就忘事,业界主流靠堆上下文窗口应对,但有缺陷。小米MiMo团队开源的MiMo Code,靠显式存储 - 检索机制,200步以上任务胜率超Claude Code达65%,介绍了其设计及优缺点。