多步推理」共找到 5594 篇相关文章

新闻资讯8

维纳智能登上Nature通讯:AI不只会回答问题,开始生成高精度行业数据

维纳智能登上Nature通讯,其让大模型自动生成高精度推理数据,用闭环反馈驱动专业Agent自主演化。该公司在领域交出工业级精度答卷,还解决了Agent泛滥的困局,推出款创新产品。

机器之心
算法论文8

ICML 2026获奖论文揭晓:黄高团队获杰出论文,A3C算法获时间检验奖

ICML 2026公布最佳论文奖项,共10篇获奖,涵盖杰出论文奖、杰出立场论文奖等。此次评选严格,经轮筛选。获奖论文涉及扩散式大语言模型、扩散模型采样算法等个领域。

机器之心
算法论文8

一夜200万阅读,OpenAI神同!这项测评框架让全球顶尖LLM全翻车

中国团队领衔全球24所高校机构发布评测LLMs for Science能力的论文,一夜阅读近200万,同一时间OpenAI也发文指出现有评测标准在AI for Science领域失灵。论文推出评测体系SDE,发现主流大模型在科学发现上短板明显。

新智元
产品应用7

Multi-Agent 的灵活编排之路

文章从Copilot 3.0架构规划模块出发,结合DeepSeek R1强化学习训练实践,探讨智能体架构下大模型编排智能体解决问题。分析Copilot 2.0局限并介绍3.0升级,指出难点,展示效果对比及解决方案。

阿里云开发者
开源动态8

这个开源 SKill,把 AI 短剧制作变成了一条可复制的工业流水线!

AI短剧圈子现开源项目shuohao - skills,是给AI编码助手用的“插件”。它将小说到可投产素材流程拆成五个模块,有清晰设计理念,每有代码级质量检查,核心亮点,能实现稳定生产。

开源星探
算法论文8

Snapchat提出Canvas-to-Image:一张画布集成 ID、姿态与布局

Canvas-to-Image 是面向组合式图像创作的全新框架,将不同控制信息整合在同一画布,简化图像生成控制流程。它解决了传统生成流程中控制方式分散的问题,能在推理阶段组合种控制信号,实验效果良好。

机器之心
开源动态7

智谱开源GLM-4.5工具调用超越Claude Opus 4.1,成本仅1.4%

开源模型GLM-4.5在伯克利工具使用榜单上超越Claude Opus 4.1,运行相同任务成本仅为1.4%。它采用MoE架构,在场景表现卓越,推理速度快,成本低,还接入款主流编程工具。

量子位
开源动态8

刚刚,DeepSeek模态技术范式公布,以视觉原语思考

DeepSeek发布模态模型并公布技术报告,提出‘以视觉原语思考’。该模型解决模态大模型‘指代鸿沟’问题,有把坐标变思维单元、7056倍视觉压缩、精心设计冷启动数据等创新,实验在任务上超主流模型。

机器之心
算法论文8

当SFT遇上RL:基于样本学习阶段的动态策略优化机制

在大模型推理能力增强研究中,SFT和RL两种后训练范式难有效融合。研究团队提出DYPO动态策略优化方法,先判断样本学习阶段再匹配优化路径,在场景实验中表现出色,不过有实验边界。

量子位
开源动态8

1.58bit不输FP16!微软推出全新模型蒸馏框架,作者全是华人

微软推出蒸馏框架BitNet Distillation,实现几乎无性能损失的模型量化。它含三阶段,经实验在下游任务表现近全精度模型,降内存开销、提推理速度,作者全是微软研究院华人。

量子位