自适应并行扩展」共找到 763 篇相关文章

算法论文8

复旦提出自适应Reasoning方法ARM,“能屈能伸”

复旦提出自适应Reasoning方法ARM,解决LLM‘过思考’问题。ARM内置四种解题策略和三种决策模式,还搭配Ada - GRPO算法,在23个数据集测试中表现出色,省token、提速度且准确率高。

深度学习自然语言处理
产品应用8

登顶TPC-C!数据库分布式扩展技术揭秘

阿里云PolarDB云原生数据库以超原记录2.5倍性能登顶TPC - C基准测试排行榜。本文揭秘PolarDB MySQL版多主集群(Limitless)架构与核心技术,还介绍高可用机制、性能测试结果,最后提及轻量版和列存索引应用。

阿里云开发者
新闻资讯7

利用Loop语言模型扩展隐式推理 | 直播预约

当前大语言模型依赖显式文本生成推理,未充分利用预训练数据。将介绍最新工作Ouro,Loop语言模型家族,核心创新多,虽参数少却性能优,还会讨论其推理轨迹及模型Scaling新可能。

深度学习自然语言处理
推荐文章7

高性能全闪并行文件系统的设计和实践

焱融科技 CTO 张文涛在 QCon 大会分享‘高性能全闪并行文件系统的设计和实践’,介绍了焱融全闪文件存储架构和 YRCloudFile 技术细节,分享其解决 AI 训练存储难题的方案。

InfoQ
算法论文8

拒绝不必要Think:微软&北大提出第一种自适应大型混合推理模型

大型推理模型冗长思考开销大,微软研究院和北大提出大型混合推理模型(LHRMs),它能依查询上下文决定是否思考。介绍了两阶段训练流程、评估指标,实验显示其超越现有模型且效率高。

PaperAgent
算法论文8

ICCV 2025 | EPD-Solver:西湖大学发布并行加速扩散采样算法

扩散模型成生成任务主流技术,但逐步去噪机制致推理延迟大。西湖大学提出 EPD - Solver 算法,融合三类加速思路优势,可减少积分误差、提升生成质量,还能作插件集成,突破扩散模型速度与质量权衡瓶颈。

机器之心
算法论文8

Agent-World:扩展真实世界环境,让智能体与环境协同进化!

文章提出Agent-World,将“智能体环境探索”与“自进化训练”结合,构建了1978个环境、19822个工具。实验表明,其在23个基准上一致性优于先进方法与强开源基础模型,还分析了环境规模与自进化对性能的影响。

机器之心
推荐文章8

大模型推理加速全链路:内存管理、编译优化、量化与并行策略

本文整理自金煜阳博士在QCon大会分享。介绍大模型推理挑战,如规模增大、架构复杂。阐述算子优化、内存管理、量化、异构调度和并行优化方法,还介绍开源推理引擎赤兔在国产芯片的实践成果。

InfoQ
算法论文8

MIT发布自适应语言模型!新任务,自生成远超「GPT-4.1合成训练数据」

麻省理工学院提出自适应语言模型框架SEAL,让大模型生成微调数据和更新指令适应新任务。实验显示,其生成的合成数据微调效果超GPT - 4.1,在少样本学习和知识整合任务表现优异。

新智元
开源动态8

7.3K Star!用 Orca 组建 AI 舰队:让 Claude Code 和 Codex 同时开工!

Claude Code 大火后,多家大厂推出自家 Code CLI,多终端操作上下文切换成本高。Orca 是开源 AI 编排器,可让多个 AI 编程助手并行工作,集中查看结果,有并行工作区、统一管理界面等亮点。

开源星探