素材生视频」共找到 1076 篇相关文章

开源动态8

加速200倍,单显卡1.8秒成5秒高清视频!清华与Vidu解开了视频扩散模型的速度枷锁

清华、数科技与伯克利联手用TurboDiffusion解开视频扩散模型速度枷锁。它改造注意力机制、引入步数蒸馏和量化策略,在多模型测试中加速100 - 205倍,且画质几乎无损。

AIGC开放社区
算法论文8

从「找视频」到「产视频」:快手RaG推动推荐系统迈向完全成时代

快手最新论文提出的 Recommendation-as-Generation(RaG),把推荐系统从「在已有视频里找答案」推进到「根据用户兴趣成答案」,已在快手大规模广告系统中部署,带来广告收入提升。

机器之心
产品应用8

实测 MiniMax H3:开源“斩杀线”蔓延到视频模型圈

本文实测 MiniMax H3 视频模型,它 8 月 3 日开源,成本低至 0.5 元/秒,在编辑榜成绩佳。它定位全模态成,能多素材输入。实测效果好,价格约为 Seedance 2.5 的三分之一,还支持原剪辑,适配多芯片与工具。

特工宇宙
产品应用8

马斯克视频成模型首次交卷!电影级运镜+音效,免费可玩

xAI的“迄今为止最强大的视频音频成模型”Grok Imagine 1.0正式全面上线。该模型支持文视频、图视频,音频效果出色,还擅长日常趣味创作。其在视频成和剪辑性能领先,官网可免费玩。

量子位
开源动态8

登顶行业SOTA的多模态视频成标杆,昆仑天工刚给开源了

昆仑天工发布的多模态视频成模型SkyReels-V3正式开源。它能文视频、图视频等,效果逼真。该模型针对现有AI视频问题实现多方面技术突破,且昆仑天工在模型和产品层面均有深厚积累。

量子位
产品应用7

实测可灵O1,AI视频界的Banana也来了。

可灵推出全新多模态视频大模型可灵O1,融合多种视频成与修改能力。实测显示,它能实现视频内容增删、特定内容修改、扣绿幕、动作迁移、风格更改等功能,虽有局限,但开启用嘴改视频新时代。

数字生命卡兹克
产品应用8

灭霸带着复联放烟花!16秒,让手搓 AI 视频拥有大片即视感

数科技的Vidu Q3超越Sora 2,位居全球第二、中国第一。它能16秒声画同出、叙事能力强、镜头和文字渲染出色,还降低了视频制作门槛,可用于漫剧、短剧、影视剧制作。

AI科技评论
新闻资讯8

数科技按下B端商业化快进键:30天签约智谱、飞书等多家行业龙头|甲子光年

AI视频成行业商业化加速,数科技不到一周官宣与智谱、飞书等合作。其Vidu基座模型能力强,多领域开花,2025年Q1商业化增速快,还凭交付与服务能力获头部青睐。

甲子光年
产品应用8

这个真人版《火影忍者》竟然是AI做的,来自中国AI视频新王者Vidu Q3

开年国产AI竞争激烈,AI视频成圈新出全球首个支持16秒音视频直出的Vidu Q3。它能全自动成,语言支持多语种,经权威认证排名中国第一、全球第二,可实现图和文视频,提升了AI视频成能力。

量子位
产品应用7

谷歌 AI Studio 实时视频对话终于支持中文了!屏幕共享+语音,Gemini 2.5 Flash 原视频加持。

谷歌AI Studio实时视频对话支持中文,有Gemini 2.5 Flash原视频对话模型。使用方便,还提供多种音色,有让模型在无声时发音视频等功能,可用于设计、学习、修电脑等场景。

AI进修生