算法论文8
DiDi-Instruct:让扩散大模型推理加速 60 倍
机器之心
AI 摘要
普渡大学等团队提出 DiDi-Instruct 后训练方法,将扩散大语言模型推理步数从 1024 步压缩至 8 - 16 步。实验显示其生成质量和训练效率大幅提升,跨领域应用潜力大。
阅读原文 · 机器之心
推理效率狂飙60倍:DiDi-Instruct让扩散大模型16步超越千步GPT
普渡大学等研究者提出 DiDi-Instruct 后训练方法,可将扩散大语言模型推理加速 60 倍,超越传统 GPT 模型。该方法实现推理效率与效果双提升,为大语言模型落地提供新方案。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
算法论文8
北大等提出 TensorCast,推理首字延迟最高降 93.2%
随着模型规模增长、新应用兴起,大模型基础设施面临管理「张量状态」挑战。北大、阶跃星辰与北邮联合提出 TensorCast,解耦张量状态,复用管理能力,在多场景测试中表现出色,为大模型基建提供新范式。
机器之心
新闻资讯7
Sonnet 5翻车,DeepSeek低价优势凸显
Anthropic发布Claude Sonnet 5,官方称补足了Agent能力,价格优惠,但开发者反应不佳。Sonnet 5因tokenizer换代,实际使用成本更高,且比同类模型贵。与之相比,DeepSeek V4 Pro便宜很多,其靠技术实现低价,海外厂商难以复刻。
鲸选AI
开源动态8
阶跃开源JetSpec,大模型解码提速近10倍
随着Agent应用爆发,大模型推理效率成AI行业焦点。阶跃星辰联合多校团队开源JetSpec,该框架面向推测解码,在H100上把MATH - 500解码速度提升到9.64倍,突破了推测解码的扩展天花板。
AIGC开放社区
开源动态8
DeepSeek 与阶跃开源方案提速大模型解码
近期,DeepSeek 推出 DSpark,阶跃星辰提出 JetSpec,都关注大模型推理效率。DSpark 关注验证效率,JetSpec 提高有效 Token 生成率。二者切入点不同,但都显示大模型行业进入新阶段,推理效率成 Agent 落地基础变量。
机器之心