优化问题」共找到 4122 篇相关文章

算法论文8

当SFT遇上RL:基于样本学习阶段的动态策略优化机制

在大模型推理能力增强研究中,SFT和RL两种后训练范式难有效融合。研究团队提出DYPO动态策略优化方法,先判断样本学习阶段再匹配优化路径,在多场景实验中表现出色,不过有实验边界。

量子位
开源动态8

微软、哈佛开源创新优化器:全面超越Muon,提升大模型训练效率

随着大模型训练所需计算资源爆炸式增长,微软和哈佛团队联合开源优化器Dion。它利用低秩近似和解耦动量缓冲区,避免分布式训练同步完整梯度,在集中式和分布式场景都有高效表现,性能超Muon。

AIGC开放社区
推荐文章8

大模型推理加速全链路:内存管理、编译优化、量化与并行策略

本文整理自金煜阳博士在QCon大会分享。介绍大模型推理挑战,如规模增大、架构复杂。阐述算子优化、内存管理、量化、异构调度和并行优化方法,还介绍开源推理引擎赤兔在国产芯片的实践成果。

InfoQ
新闻资讯7

当AI走进Second Half:真正的问题、价值与生态是什么?|甲子光年

本文是甲子光年年终盛典巅峰对话实录,探讨AI下半场问题。嘉宾们认为技术上未到下半场,但应用层面已至。大家围绕重新定义问题、评估真实价值、重构产业生态展开交流,分享见解与经验。

甲子光年
产品应用8

PD 分离推理的加速大招,百度智能云网络基础设施和通信组件的优化实践

为适应PD分离式推理部署架构,百度智能云从物理网络、网络流量、通信组件和算子层面优化,提升上层推理服务性能,展现了网络、组件与业务特征融合的重要性。

InfoQ
算法论文8

大模型“拼好题”,45K数据撬动18%提升,数学问题拒绝死记硬背 | MathFusion

上海AI Lab等团队提出MathFusion,通过三种“融合策略”生成新的融合数据集MathFusionQA,仅用45K合成指令,在多基准测试中平均准确率提升18.0个百分点,增强模型解决数学问题的能力。

量子位
算法论文8

重新审视SFT的泛化能力:优化动态、数据与模型能力的条件性分析

上海人工智能实验室等联合研究质疑了‘SFT倾向于记忆,RL实现泛化’观点,指出SFT泛化是条件性现象,受优化动态、训练数据、基模型能力影响,还揭示长思维链SFT会带来安全性能退化。

AI科技评论
新闻资讯7

十分钟出结果,陶哲轩用Gemini Deepthink帮人类数学家完成Erdős问题论证

Erdős问题网站专注数学研究与解答,收录厄尔德什提出的各类数学问题。11月20日,Wouter van Doorn提出反例,陶哲轩提交给Gemini 2.5 Deep Think,十分钟得到证明,他半小时转为基础证明。之后Boris Alexeev用Harmonic的Aristotle工具完成形式化。

机器之心
新闻资讯8

陶哲轩转发!华人数学博士后反超DeepMind AI,停滞18年数学问题1个月内3次突破

DeepMind的AlphaEvolve打破集合和差问题18年纪录,华人博士后Fan Zheng等数学家出手反击。人类用测度集中性少量辅计算机,1个月内该问题3次突破,陶哲轩称不同方法可互补推动数学进步。

量子位
新闻资讯7

GPT-5问题太多,奥特曼带团回应一切,图表弄错是因「太累了」

GPT - 5发布后问题频出,在数学、逻辑、编码任务中失误不断,还出现低水准图表错误,引发吐槽质疑。OpenAI联合创始人Sam Altman等在Reddit AMA活动中回应问题,给出解决方案并分享未来规划。

机器之心