自回归流式扩散技术」共找到 497 篇相关文章

算法论文8

扩散模型「可解释」不再降质,开启图片编辑新思路

过去三年扩散模型席卷图像生成领域,但可解释性研究是‘黑箱’,且现有尝试常致性能下降。香港中文大学与上海人工智能实验室团队提出TIDE框架,可解释且不降质,还带来新图像编辑方式。

机器之心
开源动态8

字节会师何恺明!开源连续扩散语言模型Cola DLM

字节会师何恺明,开源连续扩散语言模型Cola DLM,释出论文、代码等。该模型跳出离散token束缚,把生成过程交给连续空间,在实验中展现出稳定scaling趋势,其动机是表征而非diffusion。

量子位
算法论文8

任意条件,「可控」文生图扩散模型综述 | TPAMI'25

北京邮电大学团队在顶级期刊IEEE TPAMI发布综述,探讨文生图扩散模型可控生成技术,将核心问题概括为如何注入新型条件信号并稳定控制,从任务和方法层面梳理技术,还提及应用场景与未来方向。

新智元
算法论文8

解决扩散模型过拟合的创新框架T-LoRA

预训练大型文本到图像扩散模型定制化时,样本有限易致过拟合。AIRI和HSE大学团队提出T - LoRA框架,动态调整训练能力、用正交初始化,实验显示其在单图像和多图像任务表现优,用户更偏好其生成图像。

AIGC开放社区
算法论文8

挑战扩散回归统治!字节提出视觉生成第三种路线,让模型像人类一样边画边改

五一期间字节商业化技术团队研发出新一代视觉生成模型,其底层架构是全新的第三条路——生成精炼网络GRN。它能让AI像人一样边画边改,解决了现有模型的问题,在多项基准测试中刷新SOTA记录。

量子位
产品应用8

世界首个「实时、无限」扩散视频生成模型,Karpathy投资站台

Decart发布世界首个「实时、无限」扩散视频模型MirageLSD,输入视频流能快速转化画面,前特斯拉AI总监Karpathy投资。它在时长和延迟上有突破,也有需改进之处。

机器之心
开源动态8

科研的回归:AutoSOTA如何终结“增量式优化”的重复劳动

当前AI科研中,为提升性能指标,研究者投入大量精力做“增量式优化”,限制原创探索。AutoSOTA项目由清华与中关村学院联合发布,它基于智能体系统构建自动化方案,接管实验迭代,一周发现105个SOTA模型,推动科研回归原创。

AIGC开放社区
推荐文章7

一种可以减少 CI 回归测试套件规模的更佳方案

作者作为测试架构师,认为减少CI回归测试套件规模理论诱人但实践常失望。介绍有效处理大型测试套件的方案,如随机趋势分析、多上下文模式匹配等,还谈及无门控测试等优势,能助力管理测试集。

InfoQ
算法论文8

扩散LLM推理新范式:打破生成长度限制,实现动态自适应调节

随着扩散大语言模型成为热门,但其推理时存在预设固定长度的限制。香港中文大学 MMLab 等提出 DAEDAL,赋予模型根据问题自主调整回答长度的能力,在性能和计算效率上有提升。

机器之心
算法论文8

西湖大学提出RDPO强化学习框架,实现扩散模型并行推理加速

扩散模型“顺序去噪”特性成速度提升瓶颈。西湖大学AGI Lab提出RDPO框架,不必改动模型本身,优化其“采样导航系统”,在多基准测试中取得领先图像生成效果,解决加速问题并提供RLHF对齐新范式。

量子位