长视频编辑」共找到 1689 篇相关文章

算法论文8

CVPR 2026 | 从视觉Token内在变化量出发,实现VLM无损加速1.87倍

随着高分辨率图像与视频处理需求增,大型视觉语言模型推理效率成瓶颈。V²Drop从视觉Token内在变化量出发,采用多阶段渐进式剪枝策略,实现无损加速,在图像和视频理解场景表现卓越。

机器之心
开源动态8

让世界模型推理效率提升70倍:上海AI Lab用“恒算力”破解时记忆与交互瓶颈

上海AI Lab联合多家机构开源Yume1.5,针对视频生成构建可交互“世界模型”的核心难题,提出时空信道联合建模(TSCM),实现近似恒定计算成本的全局记忆访问,展示了世界模型工程化落地的可行路径。

量子位
产品应用8

全球唯二、国内首个,阿里万相2.6杀疯!Sora 2瞬间不香了

阿里万相2.6系列模型上线,成为业界功能最丰富的视频模型,是全球唯二、国内首个具备角色扮演功能的模型。其音画一体,能生成15s视频,指令遵循能力强。还可将提示词转换为多分镜脚本,团队公开了提示词公式。

新智元
开源动态8

「百万级」视频推理数据集!30+顶尖高校联合发布

AI视频生成已能「画得像」,但不会「想得对」。VBVR推出百万级视频推理数据集,首次系统评测模型对空间、物理、逻辑和抽象的推理能力,发现顶尖模型通过率仅68%,推动视频AI从「视觉模仿」迈向「智能推理」。

新智元
算法论文8

73%人类认同率!Video-Bench实现视频质量精准打分

上海交大等团队提出视频评估框架Video - Bench,让多模态大模型‘像人一样评判视频’。它构建双维度评估框架,引入链式查询和少样本评分技术,与人类判断73%高相关,为视频生成模型优化提供标尺。

深度学习自然语言处理
开源动态8

哔哩哔哩献给二次元世界的礼物—AniSora,目前最强大的开源动漫视频生成模型

动画视频生成评估挑战大,现有模型处理动画视频力不从心。哔哩哔哩推出AniSora综合系统,支持一键生成多种动漫风格视频镜头,在角色和动作表现上出色,在多维度超越当前先进模型。

带你学AI
产品应用8

快手AI超级员工上线!一句话剪出完整短视频,从文案到发布一条龙

快手AIGC超级员工Kwali正在内测,可一句话生成完整短视频。它整合多Agent框架,有素材库和数字人资源。能完成脚本、拍摄、剪辑等环节,降低视频制作门槛,重构视频供应链。

量子位
新闻资讯7

Andrej Karpathy 辣评Veo 3:视频生成将直接优化人类的注意力,TikTok只是弟弟

Andrej Karpathy发文对Google的Veo 3视频生成模型发表见解,指出视频生成技术进步带来四个关键转变,认为视频将成AI与人类交流绝佳界面,也引发众人对其利弊的讨论。

AGI Hunt
产品应用8

又是中国团队!一条链接出片,电商AI视频迎来「DeepSeek时刻」

电商AI视频此前生成效果不佳,难以用于投放。营赛AI发布的inSai Hilight是“下一代营销视频解决方案”,在权威评测中表现出色,能保证商品和数字人一致性,靠知识图谱等技术实现高质量视频生成。

新智元
产品应用7

图生视频新玩法刷爆外网:图上画两笔就能动起来,终于告别文本提示

Higgsfield AI 是专注 AI 视频生成的初创公司,近期发布 Draw-to-Video 和 Product-to-Video 功能,前者画图形元素就能生成视频,后者可拖拽生成广告视频。它还常上新功能、集成热门模型,官网功能模板丰富。

机器之心