算法论文8
清华英伟达联手:rCM让视频生成提速50倍
量子位
AI 摘要
清华与英伟达联合提出rCM方法,首次将连续时间一致性蒸馏用于大模型。它引入前向 - 反向散度联合优化,推理提速达50倍,兼顾生成质量与多样性,未来将用于NVIDIA Cosmos系列。
阅读原文 · 量子位
清华联手英伟达打造扩散模型新蒸馏范式!视频生成提速50倍,4步出片不穿模
清华大学朱军教授团队与NVIDIA Deep Imagination研究组联合提出分数正则化连续时间一致性模型(rCM),将连续时间一致性蒸馏扩展至大模型,解决现有方法瓶颈,提升推理速度兼顾质量与多样性。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
算法论文8
复旦&引望WAM-Diff2让自动驾驶解码提速15.1倍
视觉-语言-动作(VLA)模型是端到端自动驾驶主流技术,但自回归解码架构有瓶颈。复旦大学与引望智能联合提出WAM-Diff2,实现自回归VLA向离散扩散模型迁移,解码加速15.1倍,多任务性能不降。
机器之心
算法论文8
字节团队发现文生图Scaling新变量
ByteDance Seed团队研究发现,文生图模型中自然语言Caption变长,不意味着模型获更多视觉监督,其信息量更能预测训练损失。团队提出Structured Prompt,从两侧提升文本条件,在多任务上取得显著提升。
机器之心
新闻资讯8
ICML 2026:扩散模型与AI安全引关注
ICML 2026大奖公布,杰出论文奖中两篇扩散模型论文获奖,立场论文奖指出AI安全工具被挪用问题。时间检验奖颁给DeepMind经典论文。获奖名单显示扩散模型研究热,AI安全需审视,AI研究进入深度清理阶段。
新智元
算法论文8
中科大等揭秘扩散模型“一致性危机”
中国科学技术大学等多机构研究者发表综述,梳理超500篇论文,揭示扩散模型视觉内容合成“一致性危机”,介绍三类一致性关系、加强位置、评估问题,指出未来模型需具备冲突感知等能力。
新智元