大推理模型」共找到 9477 篇相关文章

新闻资讯8

新一代文心模型5.0正式发布,百度推高智能天花板

在2025百度世界会上,新一代文心模型5.0发布,采用全模态统一建模技术。它在LMArena榜单成绩优异,能力达世界第一梯队,有原生全模态、基础能力强等优势,还强化智能体能力。

深度学习自然语言处理
新闻资讯7

Gemini再揽金牌,力压学学霸,AI数学推理时代来了!

苏黎世联邦理工学院博士生在学生国际数学竞赛(IMC)测试了Gemini三种模式,其表现远高于金牌门槛,远超普通学生。研究人员还从模型输出提取见解,展现了Gemini在数学推理上的优势,凸显AI数学推理能力日益强

新智元
开源动态8

破局模型训练黑盒,MegatronApp开源实现万亿参数「可视可控」训练

在2025上海QCon会上,算秩未来赵伯罕博士指出万亿级模型训练困境。上海期智研究院和算秩未来联合研发MegatronApp,以低入侵方式补齐链路,其四个模块形成闭环,让训练从黑盒变白盒,项目已开源。

InfoQ
算法论文8

AAAI 2026|AP2O-Coder 让模型拥有「错题本」,像人类一样按题型高效刷题

在AI辅助Coding技术发展背景下,开源语言模型生成代码有运行错误。上交博士团队提出AP2O方法,构建AP2O - Coder框架,借鉴人类学习模式,经实验验证能提升模型性能、抑制错误、提高样本效率,还适配通用模型

机器之心
算法论文8

高瓴赵鑫团队新作:先拆掉 RLVR,再重建推理模型训练

高瓴赵鑫团队围绕RLVR框架做系统实验,完成论文《A3PO: Adaptive Asymmetric Advantage Shaping for Reasoning Models》,提出A3PO方法。该方法将训练重点转向关键决策点,让推理模型学习更可控。

AI科技评论
开源动态7

从社区数据出发,再看模型开源开发生态全景与趋势

蚂蚁开源先后在527蚂蚁技术日和外滩会发布模型开发生态开源项目全景图1.0和2.0版本。2.0版更新评估方法,呈现生态新变化,还分析技术趋势、开发者分布,提及项目进出情况及TensorFlow衰落等。

InfoQ
开源动态8

不止于快!美团新推理模型正在重新定义「实用主义AI」

美团发布并开源推理模型 LongCat-Flash-Thinking,它在权威测评表现突出。该模型有多项创新,能更快、更能干、更可靠。其将技术实力转化为业务服务能力,实战测试表现佳,体现美团实用主义 AI 路径。

InfoQ
算法论文8

Meta打开AI元认知,让AI不止会解题,还会总结套路了

Meta等机构提出‘元认知重用’机制,让模型学会反思总结。模型打造‘行为手册’,与主流RAG系统有本质区别。研究人员设计三种实战用法,虽有局限,但为模型推理难题提供了解决方案。

AIGC开放社区
产品应用7

终于敢把真实地址、银行卡、种子词直接扔给模型

作者将真实个人信息扔给多个模型测试,结果模型收到的是脱敏后的占位符,OneAIFW 能自动完成敏感信息的占位和还原,本地完成操作,不留日志不上云,还介绍了使用方法和项目地址。

GitHubStore
开源动态7

模型也能精确计算:WorldModel-Qwen的推理时代码执行实验

开发者bigattichouse让Qwen - 0.6B小模型推理时生成并执行WASM代码获计算结果。最初尝试加标签生成Python代码效率低,后用WASM,创建三层架构。虽结果未完美,但接近,还通过Gemini审查验证。

AI工程化