「多模型推理」共找到 10119 篇相关文章

新闻资讯8

百度CTO王海峰:AGI曙光已现,Scaling Law仍有效|新智元十周年峰会

新智元十周年峰会,百度CTO王海峰分享AI发展。回顾十年,从AlphaGo到如今大模型爆发,AGI曙光已现。他指出AI具通用性和全面性,百度内部超45%新增代码由AI生成,Scaling Law仍有效。

新智元
算法论文8

教AI「择偶生娃」,复刻自然演化!上交校友提名最佳论文

Sakana AI受自然演化启发提出全新模型融合进化方法M2N2,引入‘择偶机制’让AI‘竞争、择偶、繁衍’。此研究获GECCO 2025最佳论文提名,M2N2表现优于其他算法,还避免‘灾难性遗忘’。

新智元
推荐文章7

2025小结:从RL到Agentic RL

作者回顾2025年从RL到Agentic RL的发展,指出Agentic RL存在慢、不稳定、难scale的问题,还探讨了RL与推理、CoT的关系,以及RL的泛化能力,认为RL能提升模型能力但还不稳定,期待明年研究。

深度学习自然语言处理
产品应用7

Meta发布Muse Spark,MSL的首份答卷!Alexandr Wang通过了吗?

Meta发布Muse Spark,是MSL首个模型,经九个月技术栈重构,效率优先。它有原生多模态推理能力,Contemplating模式处理复杂查询,安全评估突出,产品功能升级,商业化转向明显,正逐步在Meta应用推出。

AI工程化
8

GPT-5实锤,悄悄上线代号「龙虾」!版本号曝光,实测编程惊人能改屎山代码

代号「龙虾」的神秘模型在WebDev Arena现身,网友猜测是GPT - 5,提前试用者称其编程能力惊人,能改屎山代码。多位用户表示其在代码生成等方面超越Claude,OpenAI或已秘密测试。

新智元
推荐文章7

企业AI智能体大排雷:138场顶级分享抖出的落地实情

AI智能体重塑软件工程,研究团队分析138场演讲发现搭建时精力多花在工程集成和接口对接。文章结合推理模型与人工校验,介绍企业引入智能体的架构策略、演进历程、应用差异及技术底座等内容。

AIGC开放社区
新闻资讯7

GPT-5通关《宝可梦水晶》创纪录!9517步击败赤爷,效率碾压o3三倍!

GPT-5通关《宝可梦水晶》创纪录,仅9517步击败赤爷,步数为o3的三分之一。它在主线任务效率也远超o3,如收集徽章、对战四天王等。其优势在于幻觉少、空间推理和目标规划能力强。

量子位
产品应用8

两个月前的预测成真:千问APP真的打通了阿里生态

近期AI圈动态频出,Google与沃尔玛合作搞AI购物,Anthropic发布Claude Cowork。而阿里千问App更快一步,1月15日成功接入淘宝、闪购等实现AI购物与办事。千问基于阿里生态打通内部,具备强模型与丰富生态优势。

花叔
推荐文章7

看完 Manus、Cursor 分享后的最大收获:避免 Context 的过度工程化才是关键

上下文工程优化是Agent创业公司新一年竞争重点,其信息质量很大程度决定Agent表现。文章结合Manus、Cursor团队思路,给出做好上下文工程要点,如缩减上下文、搭建工具行动空间、多Agent协作等。

Founder Park
开源动态8

只训练数学,却在物理化学生物战胜o1!新强化学习算法带来显著性能提升,还缓解训练崩溃问题

上海创智学院、上海AI Lab的MM - Eureka系列工作提出新强化学习算法CPGD,缓解训练崩溃问题,提升性能。还构建多模态强化学习框架,推出MMK12数据集和MM - PRM模型,开源相关成果。

量子位