产品应用8
通义万相2.5:一句话出1080P电影
新智元
AI 摘要
通义万相2.5全网首发,可一句话直出10秒1080P电影级视频,实现音画精准同步。它创作能力升级,支持多模态输入,采用原生多模态架构,或推动AI生成电影时代到来。
阅读原文 · 新智元
Sora 2瑟瑟发抖!通义万相2.5放大招:一句话出1080P电影,音画精准同步
云栖大会上通义万相2.5系列模型亮相,包含四大模型,视频生成模型实现音画同步突破,降低电影级视频创作门槛。它创作能力全方位升级,支持多种模态输入,采用原生多模态架构。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
产品应用7
updream预演台:破解AI视频运镜难题
用AI做视频常遇运镜、人物走位等问题,因文生视频系统缺空间锚定能力。updream在8月17日上线「预演台」功能,通过传参考图自动生成3D白模场景,实测显示其显著减少「抽卡」次数。
新智元
新闻资讯8
AI视频激战:Seedance 2.0 fast成性价比之王
近期AI视频赛道竞争激烈,FLUX 3登场,国内巨头也纷纷推出新模型。字节Seedance 2.5优势明显,但适用特定场景。Seedance 2.0 fast降至6毛每秒,经多场景实测,表现均衡,是性价比之选。
新智元
开源动态8
腾讯混元开源UniRL打通多模态RL训练
大语言模型的RL技术已成熟,但多模态生成模型的强化学习训练仍“各自为战”,制约AIGC模型能力上限。腾讯混元庞天宇团队开源UniRL框架,打通多模态RL后训练,覆盖多种模型,内置算法与奖励组件。
量子位
产品应用8
谷歌Gemini Omni:开启AI视频新纪元
谷歌在Google I/O大会推出Gemini Omni,它结合推理与生成能力,在多方面有重大飞跃,能生成逼真视频等。它打破命名体系,训练目标不同,有涌现能力,谷歌还为其设置限制。
新智元