长思考能力」共找到 4087 篇相关文章

开源动态8

社区供稿丨如何抑制大模型的“过度反思”:Yuan3.0 Flash 中的强化学习范式

大模型在企业落地时存在“过度反思”问题,浪费算力。YuanLab.ai团队在Yuan3.0 Flash模型中提出RIRM与RAPO,前者奖励“思考过程”,后者优化训练框架,实现推理效率提升,适用于企业场景。

Hugging Face
开源动态7

测试的同学要起飞啦, Cursor / Claude 党福音:一个 MCP 服务器把 Android 真机接进你的对话框

DroidMind是开源MCP服务器,将Android的ADB能力结构化暴露给支持MCP的AI客户端。适合调试、测试等场景,能让AI执行设备操作,有设备管理、调试信息获取等功能,使用体验友好且安全。

小华同学ai
新闻资讯8

GPT-5.2来了!首个「专家级」AI复仇成功,牛马打工人终于得救了

OpenAI发布GPT - 5.2「全家桶」,含即时、思考、专业三款模型。它全方位碾压谷歌Gemini 3 Pro,在多方面进化,虽价格涨40%,但性价比更高,还适合多种专业工作,甚至能辅助科研。

新智元
产品应用7

把 Nano Banana/Gemini 3 Pro 榨干!这几点你必须知道

Gemini 3 放出 Pro 和 Nano Banana Pro 两条线,前者主打上下文、多模态推理,后者专攻像素级生成。文章提炼精髓,给出“通用 + 像素”双模实战笔记,介绍两者使用要点及创意场景实测。

PaperAgent
8

全球首个AI Agent操作系统FlowithOS跑分超Atlas,网友:它「杀死」了比赛

AI应用初创企业Flowith推出全球首款专为AI Agent打造的操作系统FlowithOS。它能改写交互方式,功能超AI浏览器,跑分超竞品,还具记忆能力,适配多系统,已公测,或引发“AI操作系统”竞争。

机器之心
算法论文8

改变强化学习范式,Meta新作呼应Sutton「经验时代」预言

图灵奖得主等提出AI智能体将迎「经验时代」,但训练面临挑战。Meta研究用「早期经验」范式解决问题,包含隐式世界建模和自我反思,提升了智能体任务成功率和泛化能力

机器之心
算法论文8

性能提升11.74%!腾讯优图提出激励推理,专攻复杂指令

现有大语言模型处理复杂指令能力不足,腾讯优图研究团队提出激励推理方法。该方法能提升LLM处理复杂指令表现,在1.5B参数LLM上性能提升11.74%,媲美8B参数模型。

量子位
算法论文8

给大模型装上「思维分段引擎」:浙大InftyThink解锁无限深度推理

如今大模型上下文推理面临计算成本高、推理易中断问题。浙大联合北大团队提出InftyThink新范式,将传统推理拆成短片段并总结,突破推理度限制,在多基座模型实验中表现优异。

量子位
新闻资讯7

Anthropic 联创:2028 年实现 AI 自我构建的概率超过 60%

Anthropic 联合创始人 Jack Clark 发文称,到 2028 年底,AI 实现端到端自动化研发概率超 60%。他分析多维度测试数据,指出 AI 在代码、科研、自我训练和管理等方面能力提升,也探讨了成真后的影响,但遭黄仁勋和陶哲轩质疑。

AGI Hunt
新闻资讯8

陶哲轩ICM 2026:数学界迎来「百年新危机」,AI狂飙逼迫全行业重写游戏规则

7月24日,陶哲轩在ICM 2026演讲指出数学界正经历新危机,关乎价值观与工作方式。他围绕AI能力猜想探讨数学界如何应对,列举目标和风险,提出需升级目标,还介绍莱顿宣言建议。

AI寒武纪