全栈式优化」共找到 2925 篇相关文章

算法论文8

当SFT遇上RL:基于样本学习阶段的动态策略优化机制

在大模型推理能力增强研究中,SFT和RL两种后训练范式难有效融合。研究团队提出DYPO动态策略优化方法,先判断样本学习阶段再匹配优化路径,在多场景实验中表现出色,不过有实验边界。

量子位
产品应用8

MySQL复制延迟终结者:AliSQL 高效AI诊断和四大内核级优化

MySQL主从复制延迟损害实例可用性和时效性。AliSQL引入AI诊断定位原因,针对大表DDL、大事务、批量数据处理和小事务高并发四类场景,进行内核级优化,消除复制延迟。

阿里云开发者
开源动态8

微软、哈佛开源创新优化器:面超越Muon,提升大模型训练效率

随着大模型训练所需计算资源爆炸式增长,微软和哈佛团队联合开源优化器Dion。它利用低秩近似和解耦动量缓冲区,避免分布式训练同步完整梯度,在集中式和分布式场景都有高效表现,性能超Muon。

AIGC开放社区
算法论文8

大型语言模型稳定强化学习的新路径:几何平均策略优化GMPO

本文介绍了大型语言模型稳定强化学习新路径——几何平均策略优化GMPO。它是GRPO稳定化版本,通过优化几何平均替代算术平均,解决GRPO训练不稳定问题,在多任务实验中显著优于GRPO。

机器之心
产品应用8

360安云架构解,AI智能体如何开启「主驾」新时代?

AI发展加速,网络安危机加剧。360安云在ISC.AI 2025大会发布新产品,提出“安即服务”理念,打造AI驱动的四层架构,发布三大类智能体,为企业提供生命周期价值交付的安服务。

甲子光年
推荐文章8

AIGC生命周期业务风控白皮书,从备案到运营的合规与安实践

2025年《人工智能安治理框架》2.0版发布,凸显AI安重要性。数美科技发布《AIGC生命周期业务风控白皮书》,构建生命周期业务风控体系,涵盖备案攻略、评测要点、账号与内容风控等,还有实战案例。

InfoQ
产品应用8

PD 分离推理的加速大招,百度智能云网络基础设施和通信组件的优化实践

为适应PD分离式推理部署架构,百度智能云从物理网络、网络流量、通信组件和算子层面优化,提升上层推理服务性能,展现了网络、组件与业务特征融合的重要性。

InfoQ
产品应用8

跨越智能体落地的可信鸿沟:玄甲(AgentWard)链路防御操作系统正式发布

大模型向自主智能体演进,安威胁域化。当前安方案有局限,制约产业落地。清华大学团队推出玄甲链路安防御操作系统,构建五层纵深防御体系,已落地应用,降低安事件发生率,筑牢安防线。

机器之心
新闻资讯8

大模型七连发,外国人馋透了!阿里云栖大会栈升级够狠

阿里在2025云栖大会栈升级,发布七款通义新模型,从基础大模型到各专项领域覆盖。旗舰模型Qwen3 - Max性能超GPT - 5等,新架构Qwen3 - Next实现效率突破,多模型开源且表现出色。

机器之心
算法论文8

重新审视SFT的泛化能力:优化动态、数据与模型能力的条件性分析

上海人工智能实验室等联合研究质疑了‘SFT倾向于记忆,RL实现泛化’观点,指出SFT泛化是条件性现象,受优化动态、训练数据、基模型能力影响,还揭示长思维链SFT会带来安性能退化。

AI科技评论