重思考模式」共找到 2362 篇相关文章

开源动态7

年底,国产开源LLM又迎来一波大爆发:Qwen、美团、智谱、腾讯、百川

年底国产开源LLM大爆发,抱抱脸热榜Top10占一半。介绍了Qwen3 - TTS、LongCat - Flash - Thinking - 2601等多个模型,各有亮点,如Qwen3 - TTS覆盖多语种,LongCat支持重思考模式

PaperAgent
新闻资讯8

“商业的HTTP”来了:谷歌CEO劈柴官宣 UCP,Agent 直接“剁手”下单,将倒逼淘宝京东“拆家式构”?

近日谷歌CEO官宣Universal Commerce Protocol(UCP),目标让Agent在线购物。它能拆解购物流程,与多协议协同。谷歌补数据底座,UCP集结众多伙伴,Agent加速落地交易场景,或使电商平台构。

AI前线
算法论文8

AST | 西工大崔榕峰、张伟伟等:基于物理约束与双并行注意力UNet++的高保真度三维机翼流场构研究

传统高保真CFD模拟计算资源消耗大,现有深度学习方法处理三维流场建面临挑战。本文提出物理约束双并行注意力UNet++框架,实验表明其在流场构精度上较传统U - Net提升约10%,预测速度提升2 - 3个数量级。

力学与人工智能
算法论文8

ICLR 2026 Oral|大模型总爱「想太多」? DECS从源头消除冗余思考,实现推理token减半且性能不降反升

以DeepSeek - R1等为代表的大型推理模型存在过度思考问题,造成大量冗余计算。复旦大学等团队在ICLR 2026 Oral论文中揭示‘长度惩罚’局限性,提出DECS框架,在多基准测试中实现推理长度减半且性能提升。

机器之心
算法论文8

AI生成视频总不符合物理规律?匹兹堡大学团队新作PhyT2V:不训练模型也能让物理真实度狂飙2.3倍!

匹兹堡大学团队提出 PhyT2V 框架,论文已被 CVPR 2025 接收。该框架不依赖训练或大量外部数据,通过链式推理与迭代修正机制,增强主流 T2V 模型物理场景泛化与生成能力,应用前景广。

机器之心
新闻资讯7

微软介绍了 TypeScript 7 的更新

微软分享 TypeScript 7 最新进展,披露用 Go 写编译器计划,构建速度最高提 10 倍,降低内存占用。默认启用严格模式,是不兼容变更。开发者看法不一,有人赞性能提升,有人忧工具迁移。

InfoQ
新闻资讯7

网友晒 21 页 PDF 质疑 Grok 3 套壳 Claude,Grok 3 自己承认了!xAI 工程师被喷无能

网友 GpsTracker 爆料,埃隆·马斯克旗下 xAI 公司的 Grok 3 模型在“思考模式”下自称是竞争对手 Anthropic 公司的 Claude 3.5。网友提供对话记录和 21 页 PDF 佐证,引发社区对模型异常原因的讨论。

InfoQ
推荐文章8

Claude code让程序员消失,Anthropic却说用AI编程会让你变傻

Anthropic科学家实验发现,新手过度依赖AI编程,概念理解、代码阅读和调试能力显著退化,效率未提升。研究识别六种AI使用模式,指出主动思考才是技能形成途径,应保留人脑训练的“摩擦力”。

AIGC开放社区
推荐文章7

SEO->GEO?大模型时代如何构建人类获取信息新范式

文章指出百度信息入口根基被侵蚀,或被DeepSeek替代。还阐述互联网大势格局,如基模最终收敛,互联网盈利模式从用户免费-营销付费向用户付费转变,高价值真实信息将构互联网。

Agent的潜意识
算法论文8

复旦提出自适应Reasoning方法ARM,“能屈能伸”

复旦提出自适应Reasoning方法ARM,解决LLM‘过思考’问题。ARM内置四种解题策略和三种决策模式,还搭配Ada - GRPO算法,在23个数据集测试中表现出色,省token、提速度且准确率高。

深度学习自然语言处理