算法论文8
NVIDIA等推出Fast - dLLM v2,吞吐量提升2.5倍
机器之心
AI 摘要
NVIDIA、港大、MIT 联合推出 Fast - dLLM v2,将 AR 模型适配为 Block Diffusion LLM,只需约 1B tokens 微调,端到端吞吐量最高提 2.5 倍,成本低且精度可比。
阅读原文 · 机器之心
NVIDIA港大MIT联合推出Fast-dLLM v2:端到端吞吐量提升2.5倍
自回归大语言模型推理效率受限,Fast - dLLM v2 由 NVIDIA、港大、MIT 联合推出。它将预训练 AR 模型适配为能并行解码的 Block - dLLM,用约 1B tokens 微调,端到端吞吐量最高提升 2.5 倍,精度相当。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
算法论文8
JustGRPO:让扩散语言模型回归极简
本文提出回归极简的方法 JustGRPO,在 RL 阶段让模型自回归生成,用标准 GRPO 训练,能超越各类针对 dLLM 设计的 RL 算法表现,提升推理表现同时保留并行解码能力。
机器之心
开源动态8
上交联合UCSD:Jacobi Forcing破LLM推理瓶颈
大语言模型推理速度是应用瓶颈,传统方法各有弊端。上交和UCSD团队提出Jacobi Forcing方案,无需重构架构,将AR模型转为并行解码器,提速显著且质量损失小,核心优势多,技术路线全链路优化,实测表现优。
机器之心
算法论文8
颜见智团队:启发学习让大模型自我进化
当下大模型能力多靠人为框架,能力上限受限。文章提出“启发学习”,将其集成到推理侧成Isaac框架,通过Prompt与网络层注入复用旧经验,实验显示能大幅提升大模型任务性能。
机器之心
算法论文7
云蝶科技:两篇顶会论文助力机器人上岗
在WRC世界机器人大会上,云蝶科技发布RoboForge系统级具身大脑和WING任务型本体。其科研团队两项成果POLIA与Strat-Reasoner发表于ICML 2026,从视觉证据和他者意图两方面,为理解具身大脑技术提供切口。
AI科技评论