视频蒸馏」共找到 1088 篇相关文章

开源动态8

500万视频数据集+全新评测框架!北大开源主体一致性视频生成领域新基建OpenS2V-Nexus,生成视频 「像」 又 「自然」

北大团队推出开源套件OpenS2V - Nexus,含全球首个S2V细粒度评测基准OpenS2V - Eval和500万条高质量人物文本视频三元组数据集OpenS2V - 5M,还评测18个S2V模型,揭示主流模型能力差距。

机器之心
开源动态7

从科学论文自动生成视频

该项目解决学术演示两核心问题,用智能体PaperTalker生成视频,还设Paper2Video基准评估。介绍了PaperTalker使用步骤,含环境、配置、推理,也说明了Paper2Video评估指标及运行方法。

GitHubStore
开源动态7

全新开源视频换装框架MagicTryOn

现有视频虚拟试穿(VVT)方法在时空一致性和服装内容保留方面有挑战,浙大提出全新开源视频换装框架MagicTryOn,利用全自注意力机制统一时空建模,设计服装保留策略,还引入掩码感知损失。

带你学AI
新闻资讯7

The Batch: 868 | AI 视频走向主流

生成式视频席卷网络爆款、广告宣传,甚至登陆 Netflix 剧集。如 Dor Brothers 用 AI 打造爆款视频,Genre.ai 低成本制作广告。各主体制作方式有别,顶尖模型开发商也积极与影视方合作,AI 正改变影视业。

DeeplearningAI
产品应用8

1w颗星!本地化视频翻译配音工具!

KrillinAI是多功能音视频本地化与增强方案,面向人类用户和AI Agent。它功能全,覆盖视频处理完整链路;特点多,支持CLI调用等;还兼容多种语音识别、大语言模型和TTS服务,可Docker部署。

GitHubStore
推荐文章7

根据 YouTube 视频生成 Blog 文章的提示词

文章给出根据YouTube视频生成Blog文章的提示词,涵盖核心创作原则、文章生成流程与要求、全局风格与限制等,指导创作者将视频内容转化为优质博客文章。

宝玉AI
新闻资讯8

不得了,这个新技术把视频压缩到了0.02%!

中国电信人工智能研究院的生成式视频压缩(GVC)技术,将视频数据压缩率干到0.02%,还能保持画面高清连贯和细节。它以‘用计算换宽带’为核心理念,在实测中表现优异,有诸多应用场景。

量子位
产品应用8

字节Lynx:从单张图像生成高保真个性化视频

字节推出高保真个性化视频生成框架Lynx,基于开源的Diffusion Transformer,引入ID - adapter和Ref - adapter,在基准数据集表现优异,能平衡身份保真度等,还可拓展至多模态和多主体。

带你学AI
新闻资讯7

Sora终于开放上传真人照片生成视频

本周起,符合条件的Sora用户可上传含人物照片制作视频,使用前需声明获人物同意。这是Sora受期待功能之一,有严格限制,且照片转视频功能审查更严,此为OpenAI平衡之举。

AI工程化
7

被曝蒸馏DeepSeek还造假!欧版OpenAI塌房了

被誉为欧洲版OpenAI的Mistral被离职员工爆料多项黑幕,其最新模型疑似直接蒸馏自DeepSeek,却包装成RL成功案例,歪曲基准测试结果。此前就有人发现其模型与DeepSeek相似,目前官方暂无回应。

量子位