「多步聚合训练」共找到 5741 篇相关文章

算法论文7

苹果出手!改进GRPO,让dLLM也能高效强化学习

苹果研究团队针对扩散语言模型(dLLM)在编码任务中表现不明的问题,基于7B级代码生成MDM DiffuCoder展开研究,定制优化GRPO提出coupled - GRPO算法,填补开源dLLM训练和推理机制空白。

机器之心
产品应用7

高通Nuvia架构介绍

本文详细介绍高通Nuvia架构。Nuvia由经验丰富芯片设计师创立,后被高通收购,旨在强化自研技术、拓展市场。Oryon CPU架构是其成果,虽面临法律争议,但设计独特,多方面表现出色,还具备安全功能和较高性能。

芯师爷
新闻资讯7

孙凝晖院士:集成芯片带来三大科学问题

随着摩尔定律发展放缓,集成芯片与芯粒技术对高性能芯片设计制造愈发重要。孙凝晖院士在2025年度晶上系统生态大会指出,集成芯片是提升性能新路径,但芯粒集成度提升带来三大科学问题。

芯师爷
算法论文8

大模型到底是怎么「思考」的?第一篇系统性综述SAE的文章来了

在大语言模型时代,人们需要“能解释”的LLM。SAE技术崛起,作者团队发布首篇SAE综述,梳理其技术、演化和挑战。介绍了SAE概念、优势,涵盖其技术框架、可解释性分析等多方面内容。

机器之心
推荐文章7

困在平台算法里,内容创作做流量到底还重不重要?【必看】

白杨SEO结合多件事,探讨内容创作做流量是否重要。指出平台算法以内容分发推荐为主,创作者是否被困取决于自身信息获取方式,AI时代创作者仍重要,还给出破局平台推荐算法的三条建议。

白杨SEO优化教程
算法论文8

全球首次,Transformer「混血」速度狂飙65倍!英伟达已下注

康奈尔、CMU等机构研究者提出「混合体」Eso - LM,融合自回归和离散扩散模型范式。它引入KV缓存机制,推理速度相比标准MDM提升65倍,在速度与质量平衡上超越BD3 - LM,引发AI领域关注,英伟达或押注此方向。

新智元
8

昨夜,全球AI 集体宕机!

昨夜全球互联网大崩溃,谷歌云服务故障致13项服务崩溃,AI服务全军覆没,OpenAI也受影响,三大云巨头同时宕机,连锁反应使多平台瘫痪。事件暴露互联网脆弱性,给人们敲响警钟。

AGI Hunt
算法论文8

最大的开源GraphRag:知识图谱完全自主构建|港科大&华为

香港科技大学KnowComp实验室与香港华为理论部提出AutoSchemaKG框架,可自主构建知识图谱,无需预定义模式。该系统利用大模型提取知识三元组并归纳模式,构建了ATLAS系列知识图谱,经测试表现优异。

量子位
算法论文8

CVPR 2025 | 多模态统一学习新范式来了,数据、模型、代码全部开源

中国人民大学、清华和腾讯合作的CVPR 2025论文指出,当前多模态学习范式有缺陷。为此提出新范式,构建AV - UIE数据集、Crab框架,实现任务互助,在多任务上超垂类专家模型,数据、模型、代码开源。

机器之心
算法论文8

比自回归更灵活、比离散扩散更通用,首个纯Discrete Flow Matching多模态巨兽降临

近年来多模态大模型多采用自回归架构,推理缺乏灵活性。香港大学和华为诺亚方舟实验室研究团队提出FUDOKI,基于全新非掩码离散流匹配架构,能并行去噪、动态修正,为多模态模型开辟新路径。

机器之心