素材生视频」共找到 1079 篇相关文章

算法论文8

10秒视频token超5万,O(n²)跑不动?用后训练线性化框架实现1.71倍加速,推理成本大降|CVPR'2026

视频成进入大规模时代,但计算成本高,自注意力复杂度O(n²)跑不动。研究团队提出LINVIDEO后训练框架,无需数据和重新预训练,实现视频扩散模型线性化替换,保持成质量,加速推理并降低成本。

量子位
开源动态8

开源音视频同步SOTA基座:极简的单流架构,2秒出片

AI视频成迈入音视频同步新纪元,闭源巨头已展实力,而上海创智学院与Sand.ai联合发布的开源音视频成基础模型daVinci - MagiHuman,以极简单流架构,2秒就能在1张H100显卡上成精准音视频同步画面。

AIGC开放社区
开源动态8

阿里开源14B电影级视频模型!实测来了:免费可玩,单次成时长可达分钟级

昨夜阿里发布14B视频模型Wan2.2 - S2V,仅需一张图片和一段音频,就能成电影级数字人视频。该模型发布即开源,可在通义万相官网免费体验,单次成时长可达分钟级。

量子位
开源动态8

Gemini 3 Pro加持!这款开源神器 Clipsketch AI,帮你自动抓帧、画图、写爆文!

自媒体内卷,‘视频转图文’是流量入口,简单截图难满足需求。clipsketch - ai 开源项目用 Gemini 3 Pro 和 Nano Banana Pro 模型,实现视频理解、AI 绘画和写作自动化,解决创作者素材整理、版权等痛点。

开源星探
产品应用8

小白也能玩转AI视频!即梦Agent模式实测:一句话搞定插画、海报、Vlog

即梦AI新上线Agent模式,用户只需一次输入指令,就能从图到视频全搞定。该模式还具备AI小助手功能,能满足多种需求。它基于Seedream 4.0模型,将AI图降至0门槛,官网现推出免费图活动。

量子位
产品应用8

刚刚,阿里「欢乐马」正式上线,抢先实测这匹「黑马」

4月27日,阿里ATH团队上线视频成模型HappyHorse 1.0。它依托多模态架构,音视频创作编辑一体,价格实惠。支持文、图、多图参考视频视频编辑功能强大,能精准替换主体、添加元素、改变风格。

机器之心
开源动态8

「百万级」视频推理数据集!30+顶尖高校联合发布

AI视频成已能「画得像」,但不会「想得对」。VBVR推出百万级视频推理数据集,首次系统评测模型对空间、物理、逻辑和抽象的推理能力,发现顶尖模型通过率仅68%,推动视频AI从「视觉模仿」迈向「智能推理」。

新智元
算法论文8

73%人类认同率!Video-Bench实现视频质量精准打分

上海交大等团队提出视频评估框架Video - Bench,让多模态大模型‘像人一样评判视频’。它构建双维度评估框架,引入链式查询和少样本评分技术,与人类判断73%高相关,为视频成模型优化提供标尺。

深度学习自然语言处理
开源动态8

哔哩哔哩献给二次元世界的礼物—AniSora,目前最强大的开源动漫视频成模型

动画视频成评估挑战大,现有模型处理动画视频力不从心。哔哩哔哩推出AniSora综合系统,支持一键成多种动漫风格视频镜头,在角色和动作表现上出色,在多维度超越当前先进模型。

带你学AI
7

并行扩散架构突破极限,实现5分钟AI视频成,「叫板」OpenAI与谷歌?

近日,CraftStory 推出 Model 2.0 视频成系统,凭借并行扩散架构破解视频时长难题,可成长达五分钟视频。其由 OpenCV 创建者 Victor Erukhimov 创立,此次突破或为企业带来商业价值,还计划开发新模型。

机器之心