「动态思考」共找到 976 篇相关文章
GPT-5.2来了!首个「专家级」AI复仇成功,牛马打工人终于得救了
OpenAI发布GPT - 5.2「全家桶」,含即时、思考、专业三款模型。它全方位碾压谷歌Gemini 3 Pro,在多方面进化,虽价格涨40%,但性价比更高,还适合多种专业工作,甚至能辅助科研。
告别「一条路走到黑」:通过自我纠错,打造更聪明的Search Agent
为解决知识实时性和推理复杂性挑战,搜索智能体(Search Agent)应运而生,但缺乏自我纠错能力。腾讯联合清华提出 ReSeek 框架,引入动态自我修正机制,还构建 FictionalHot 数据集评估,实验效果良好。
给定"标价"的 LLM 智能体,能规划出"最优"路径吗?
在LLM智能体多轮工具使用中,评估成本是难题。来自多所高校的团队推出CostBench基准,围绕旅行规划构建评估环境。评估顶尖模型发现其规划与适应能力有短板,并分析失效根源,还指出下一代智能体演进方向。
离GPT-5最近的一次!中国1万亿参数开源巨兽突然爆火
月之暗面发布全新模型Kimi K2 Thinking,自称开源「思考Agent模型」。它参数约1万亿,性能亮眼,碾压GPT - 5等,能连续调200 - 300次工具,已上线并开源API和权重,开发者可试用。
DeepMind一篇论文终结十年之争!GPT-5推理靠世界模型
GPT-5上线后推理能力惊人。最新研究揭示通用智能体聪明的原因是长出“世界模型”,终结了学界十年关于AI靠模仿还是思考的争论,实验也验证了世界模型对智能体的必要性。
软件的新玩法:如何 Fork 一个技能库|AGIX PM Notes
文章围绕软件新玩法展开,指出软件正从面向人向面向机器转变,Claude Skills 代表新范式,软件或消解为面向 LLM 的 skill.md 文件。还涵盖市场总结、AI 动态及 ETF 知识等内容。
Meta打开AI元认知,让AI不止会解题,还会总结套路了
Meta等机构提出‘元认知重用’机制,让大模型学会反思总结。大模型打造‘行为手册’,与主流RAG系统有本质区别。研究人员设计三种实战用法,虽有局限,但为大模型推理难题提供了解决方案。
美团开源新模型,多项能力实测第一
美团发布5600亿参数的LongCat - Flash模型,有创新动态计算机制和高效训练推理架构。它在多项测评中领先,尤其在代理工具使用测试表现出色,还以宽松许可开源,降低使用门槛。
Meta提出Deep Think with Confidence:几乎啥都不用动,就能提升推理的准确性与效率
传统自一致性方法虽能提升推理准确率,但计算开销大、收益递减。Meta AI与UCSD团队提出Deep Think with Confidence(DeepConf),可在不增训练成本和不调超参数下,提升推理准确性与效率,本文对其全面解读。
X-Actor 惊艳登场!长时唇动+情感同步人像动画生成
字节提出 X - Actor,一个音频驱动自回归扩散框架,能通过一张静态参考图像和一段音频生成逼真、富有情感表达的人像动画视频。其核心是两阶段解耦生成流程,实现长时间唇形同步与情感音频一致性。