「可交互音视频」共找到 5029 篇相关文章
训练成本暴降99%,35秒出1分钟高清视频!英伟达MIT等引爆视频AI革命
英伟达联合MIT、港大团队提出SANA - Video架构,其核心是创新的全局线性注意力Diffusion Transformer训练框架和全局显存恒定的KV缓存机制。它训练成本低、速度快、可部署,重新定义AI视频生成效率极限。
图像、视频一模搞定!字节全能原生多模态本地可部署
字节开源原生多模态模型Lance,仅3B激活参数,40G显存就能跑,已登顶huggingface趋势榜。它能进行图像与视频的理解、生成、编辑等操作,在多个基准测试中表现优异,多项性能居首。
昆仑万维多模态视频生成开源,影音图文全统一
昆仑万维开源的SkyReels-V3,通过统一多模态上下文学习框架,实现参考图像生成视频、视频持续扩展及音频驱动虚拟数字人功能,在视觉质量与指令跟随性上逼近闭源顶尖水平,为开源社区提供强大研究基座。
互联网黑话之西游记版 AI 视频的制作方法
文章介绍互联网黑话之西游记版AI视频制作方法。先与AI共创剧本,以互联网黑话结合西游记场景为佳;再让AI根据剧本和人物形象图生成包含多内容的分镜脚本,生成首帧图后按脚本制作视频,不满意可反复生成再拼接。
把短视频做成流水线的AI剪辑神器
Pixelle-Video是一款AI剪辑神器,输入主题就能自动完成视频创作,零门槛。它采用模块化设计,流程清晰,各环节可灵活定制。支持多种AI模型、TTS方案,有丰富功能亮点。
Wan 2.6 发布,可以参考视频进行角色扮演 & 终于有积分了:每天 150
Wan 2.6发布,积分从每天10个提升到150个。更新了主演、多镜头叙事、图像生成等新功能,如可将参考视频角色放入新场景,简单提示自动生成多镜头叙事视频等。
又一 AI 视频创作产品火了,用户抢着付费,附实测
Flova 这款 AI 视频创作产品火了,用户抢着付费。它是人和 AI 协作共创的通用视频创作 Agent,无需专业知识,通过对话和故事板完成创作,还支持修改部分内容、一键回溯等,有多种高级玩法。
让机器人看视频学操作技能,清华等全新发布的CLAP框架做到了
近日,清华联合星尘智能、港大、MIT提出 CLAP 框架,能将视频运动空间与机器人动作空间对齐,解决‘数据饥荒’‘视觉纠缠’等问题,可让机器人从视频学技能,还缓解知识迁移难题,推动机器人产业化。
开源AI教育视频生成神器,3Blue1Brown风教学动画一键搞定!
新加坡国立大学Show Lab团队开源Code2Video,能让代码变高质量教育视频,逻辑是用代码驱动视觉效果。它有智能解析等特性,可解决传统教学视频形式单一等问题,应用场景广泛。
13.8K star!!6G显存就能跑的AI视频神器,支持1分钟生成,这么6?!
现在AI视频生成领域仍面临高算力需求挑战,斯坦福大学研究团队推出`FramePack`项目,降低了本地AI视频创作硬件门槛,有低硬件需求、高效生成速度等特色,操作也简单。