算法论文8
快手与港科大团队发布视频生成模型UnityVideo
量子位
AI 摘要
港科大等团队提出UnityVideo框架,通过统一训练多模态,使模型更懂物理规律、视频生成更优,实现零样本泛化,在多任务表现出色,为视频生成领域开辟新路径。
阅读原文 · 量子位
统一视觉多模态与多任务!快手可灵与港科大团队发布视频生成模型,加速真实世界理解
港科大、港中文、清华和快手可灵团队提出全新视觉框架UnityVideo,统一训练多种视觉模态,让模型更懂物理规律,视频生成更真实可控,还实现零样本泛化,在多任务表现优异。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
开源动态8
Sand.ai开源千亿MoE视频生成模型
Sand.ai团队开源全球首个千亿MoE视频生成模型MAGI - 2 - preview,总参数114B,单次前向激活约6B,成本低效果好。该模型解决了视频生成Scaling难题,架构、系统设计出色,开源将改变行业规则。
量子位
开源动态8
MemoBench:捅破世界模型评测最大盲区
过去一年,‘世界模型’成视频生成领域热词,厂商强调产品要模拟真实世界运行规律,但业界评测一直未能精准检验其‘物体恒存’的认知能力。为此,研究者提出新基准MemoBench,测试了主流模型,揭示其短板。
机器之心
8
快手拟分拆可灵AI,估值200亿美元
The Information爆料,快手计划分拆旗下视频生成模型可灵AI,目标估值200亿美元并计划明年IPO。可灵已开始盈利,在海外表现出色。快手拆分是因估值重构、资源压力和人才等三层压力。
量子位
算法论文8
VEGA - 3D:释放视频模型3D知识
华中科技大学与百度联合提出VEGA - 3D,释放视频生成模型隐式3D知识。它将视频生成模型作‘潜在世界模拟器’,用自适应门控融合机制,提升场景理解等任务表现,无需额外3D标注数据。
机器之心