「微调加速」共找到 886 篇相关文章
字节清华智能体自动写CUDA内核,比torch.compile加速2.11倍
字节Seed与清华AIR团队开源CUDA Agent,在GPU内核优化基准KernelBench上成绩优异。它是大规模智能体强化学习系统,训练数据经多阶段构建,分阶段训练,全面超越商业模型,还开源了训练数据集。
Nature | 清华&芝大团队:AI让个体科学家“加速”,却让科学边界“收缩”
2026年1月14日,清华与芝大团队在《Nature》发表研究,通过分析4100余万篇论文,揭示AI融入科研的“双重效应”:它是个人科研“加速器”,让使用者产出和职业发展提升;也是科学整体“收缩器”,使集体知识疆域收窄。
砂之船 × 炎黄盈动:基于企业级AI平台,加速智能商业运营落地
砂之船集团作为大型奥莱运营商,2025年选择炎黄盈动企业级AI平台,从现场运营切入推进AI落地。该平台解决业务挑战,提升管理效率超60%,助力集团多方面价值提升,为行业提供示范。
RAG效果不佳?先别急着微调模型,这几个关键节点才是优化重点
文章深入探讨RAG技术实现与优化,指出其在AI应用开发中常被当黑盒,从文档分块、索引增强、编码、混合检索到重排序等关键环节解析,强调结合场景调优以提升召回与精确率。
无需CUDA代码给H100加速33%-50%,Flash Attention作者新作火了
Flash Attention、Mamba作者之一Tri Dao与普林斯顿博士生提出QuACK库,用Python写,无需CUDA C++。在H100上比优化库快33%-50%,吸引英伟达、PyTorch团队关注。还给出优化torch.compile建议。
微软开源多智能体自定义自动化工作流系统,加速搭建基于AI的自动化系统
微软开源多智能体自定义自动化工作流系统,可助企业用AI智能体实现复杂组织任务自动化。该方案整合多项Azure服务构建管道,有聚焦核心价值等功能,还给出部署指南与成本估算。
Agent的自演进,被刚刚开源的AReaL 2.0按下了加速键
Agent 正从「会使用工具并完成任务」向「在使用中学习并改进方法」转变,但面临自演进难题。AReaL 2.0 上线,解决 Agent 服务侧问题,给出在线学习闭环方案,其价值已在实践中得到验证。
探索 GPU 加速向量检索:NVDIA Cagra 在微信大规模推荐系统中的应用实践
本文分享腾讯团队将 Cagra GPU 图索引大规模应用于微信核心线上推荐业务的实践。介绍 Cagra 算法原理与优势,讲述线上化改造、架构演进、CPU/GPU 协同优化等,展示业务落地显著收益。
无问芯穹首曝智能体服务平台,以基础设施加速企业级「智能体自由」
12月16日,无问芯穹在智能体生态论坛发布智能体服务平台。该平台为企业提供全链路陪伴式落地服务,解决生产级智能体落地和规模化的难题,助力企业实现智能体的高效商业化落地与可持续运营。
腾讯发布超低成本AI训练法!120元效果秒杀70000元微调方案
腾讯提出无训练组相对策略优化Training-Free GRPO,无需调整参数,在提示词中学习经验就能提升模型性能。实验显示,该方法在数学推理和网页搜索任务上效果显著,成本远低于传统方法。