视频分镜」共找到 1565 篇相关文章

算法论文8

10秒视频token超5万,O(n²)跑不动?用后训练线性化框架实现1.71倍加速,推理成本大降|CVPR'2026

视频生成进入大规模时代,但计算成本高,自注意力复杂度O(n²)跑不动。研究团队提出LINVIDEO后训练框架,无需数据和重新预训练,实现视频扩散模型线性化替换,保持生成质量,加速推理并降低成本。

量子位
开源动态8

开源音视频同步SOTA基座:极简的单流架构,2秒出片

AI视频生成迈入音视频同步新纪元,闭源巨头已展实力,而上海创智学院与Sand.ai联合发布的开源音视频生成基础模型daVinci - MagiHuman,以极简单流架构,2秒就能在1张H100显卡上生成精准音视频同步画面。

AIGC开放社区
开源动态8

阿里开源14B电影级视频模型!实测来了:免费可玩,单次生成时长可达钟级

昨夜阿里发布14B视频模型Wan2.2 - S2V,仅需一张图片和一段音频,就能生成电影级数字人视频。该模型发布即开源,可在通义万相官网免费体验,单次生成时长可达钟级。

量子位
推荐文章8

11Labs 增长负责人:搞营销要学着做视频,但创始人出会有点自恋

AI语音独角兽ElevenLabs增长迅猛,估值超30亿美元。其增长负责人Luke Harries享独特策略,如业务单元管理、重视视频营销、多渠道推广等,还给出团队搭建、产品发布等实用建议。

Founder Park
产品应用7

FairyGen:AI 把孩子的画“动”起来,个性化教育和动画创作

FairyGen 能将孩子画作变成卡通短片,通过多模态大语言模型构思脚本,采用层建模处理前景人物动作与背景动态。其生成流程四阶段,但也存在前景角色重建不准、背景生成不稳定等问题。

带你学AI
算法论文8

AAAI|东方理工陈云天等:教会视频扩散模型“理解科学现象”,从初始帧生成整个物理演化

东方理工陈云天等团队在论文中提出让视频扩散模型学习“潜在科学知识”的框架,方法三步,在流体和台风数据实验中表现超主流方法,展示生成式AI在科学建模的探索。

力学与人工智能
开源动态8

GLM-5.1夺开源模型第一,长程任务更稳,一句话就能生成文章短视频

智谱官宣GLM-5.1开源,代码能力增强,在三项代码评测基准综合平均上,取得全球模型第三、国产及开源模型第一。它专为长程任务设计,能8小时持续工作,还能一句话生成短视频,是平替Claude Sonnet 4.6的优选项。

AI工程化
推荐文章8

火爆全网的《卢浮宫小猫》AI视频万字创作心得享,这可能是他们最毫无保留的一次。

数字艺术家海辛和阿文享《卢浮宫小猫》AI视频全流程创作心得,从选角、定调、音乐、、美术到动画等环节,还提及废稿情况,强调模型便捷不应成偷懒理由,要把作品做得更好。

数字生命卡兹克
开源动态8

「百万级」视频推理数据集!30+顶尖高校联合发布

AI视频生成已能「画得像」,但不会「想得对」。VBVR推出百万级视频推理数据集,首次系统评测模型对空间、物理、逻辑和抽象的推理能力,发现顶尖模型通过率仅68%,推动视频AI从「视觉模仿」迈向「智能推理」。

新智元
算法论文8

73%人类认同率!Video-Bench实现视频质量精准打

上海交大等团队提出视频评估框架Video - Bench,让多模态大模型‘像人一样评判视频’。它构建双维度评估框架,引入链式查询和少样本评技术,与人类判断73%高相关,为视频生成模型优化提供标尺。

深度学习自然语言处理