「Next - Frame Diffusion」共找到 86 篇相关文章
今日硅谷科技头条是一个游戏机
V社连发VR头显Steam Frame、游戏主机Steam Machine和新款手柄Steam Controller三款游戏硬件,预计2026年初推出。Steam Frame亮点多,Steam Machine性能强,Steam Controller适合PC玩家,V社构建起软硬件+内容闭环生态。
每次画架构图都快崩溃?这个开源 AI 版 draw.io 一句话帮你搞定
Next AI Draw.io是基于Next.js + draw.io的开源Web应用,给draw.io加了AI大脑。它能让用户用自然语言画图、改图、补图,解决画架构图等耗时费力问题,有诸多功能亮点,适合特定人群。
开源模型叫板Nano Banana Pro!Stable Diffusion原班人马杀回来了
时隔一年,上一代AI生图顶流Flux带着新模型Flux.2杀回来了。该模型发布即开源,生图质量媲美谷歌Nano Banana,价格却便宜得多。它有多个版本可选,实测在指令遵循、精细控制方面有进步,但与Nano Banana Pro仍有差距。
与Gemini Diffusion共振!首个扩散式「发散思维链」来了
西湖大学齐国君教授团队提出扩散式「发散思维链」,这是面向扩散语言模型的新型推理范式。它与传统思维链不同,能非线性生成,已应用于两种模型,增强后的模型在相关任务上超越现有模型。
4倍无损压缩Diffusion,6倍加速!仅需时间特征维护 | TPAMI'25
扩散模型时间特征对量化敏感,现有量化方法会致其扰动,影响图像质量。港科大等多校团队提出TFMQ - DM框架,优化时间特征相关模块,提升低比特量化性能,实现硬件加速。
AI文本转语音进入“Next Level”!独角兽ElevenLabs发布Eleven v3:狠狠拿捏情感控制
独角兽ElevenLabs发布最新版TTS模型Eleven v3,支持70多种语言,能进行多人对话,生动展现情绪语气。官方称其为“迄今为止最具表现力的文本转语音模型”,网友实测好评居多,但中文效果不如英文。
用Diffusion构建「AI虚拟细胞」,14项指标霸榜!Mila唐建团队破解单细胞「破坏性」测序难题
Mila唐建团队发表PerturbDiff,跳出前人认知盲区,将“细胞群体的概率分布”视为随机变量。它引入数学工具建模,让MMD内生于体系,在多项基准测试霸榜,还提供应对数据稀缺的思路。
通过零开销逐层权重卸载技术将SGLang Diffusion wan2.2的推理速度加速60%
文章介绍在优化SGLang对Wan2.2视频生成模型支持时,发现双Transformer架构下第1步和第19步推理慢的问题。通过零开销逐层权重卸载技术,将整体推理速度提升60%,还突破显存墙,且该优化可扩展到其他模型。
视频生成不再「断片」:OneStory给模型装上「选择性记忆」,跨镜头讲故事人物场景始终如一丨CVPR'26
多镜头视频生成挑战大,现有方法有局限。Meta与哥本哈根大学研究者提出OneStory,为多镜头视频生成建立跨镜头记忆机制,可生成连贯长视频,在复杂叙事中保持一致。
近500页史上最全扩散模型修炼宝典,宋飏等人一书覆盖三大主流视角
宋飏等人所著《The Principles of Diffusion Models》共460多页,系统梳理扩散模型发展脉络与核心思想,以统一数学框架串联多种视角,是研究者参考资料与初学者入门读物。