产品应用7
阿里通义万相2.6:全球功能最全视频模型
量子位
AI 摘要
阿里通义万相2.6:功能全,可文生视频、图生视频等。视频创作有音频驱动等新能力,文生图也补强。虽有画面逻辑偏差小问题,但日常创作已好用。
阅读原文 · 量子位
全球功能最全的视频生成模型来了
阿里发布新一代通义万相2.6系列模型,是全球功能最全的视频生成模型,覆盖文生视频等多种模式。它在视频创作和文生图方面能力提升,虽有小瑕疵,但日常短视频和二创已可用。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
开源动态8
Sand.ai开源千亿MoE视频生成模型
Sand.ai团队开源全球首个千亿MoE视频生成模型MAGI - 2 - preview,总参数114B,单次前向激活约6B,成本低效果好。该模型解决了视频生成Scaling难题,架构、系统设计出色,开源将改变行业规则。
量子位
开源动态8
MemoBench:捅破世界模型评测最大盲区
过去一年,‘世界模型’成视频生成领域热词,厂商强调产品要模拟真实世界运行规律,但业界评测一直未能精准检验其‘物体恒存’的认知能力。为此,研究者提出新基准MemoBench,测试了主流模型,揭示其短板。
机器之心
产品应用8
谷歌双发:打通AI图生视频流水线
谷歌深夜上线Nano Banana 2 Lite和Gemini Omni Flash。前者是最快最便宜文生图模型,4秒生图且成本低;后者是视频生成模型,支持多模态输入和对话式编辑。二者串联打通创作流水线,还集成SynthID水印技术。
新智元
算法论文8
何恺明携本科生推小参数文生图模型
何恺明携本科生团队推出文生图模型MiniT2I,基于MM - JiT架构,仅用258M参数实现不错效果,训练成本低。该架构删繁就简,去掉VAE和AdaLN等模块,性能提升,展现出与工业级模型的竞争力。
量子位