实时视频生成」共找到 2856 篇相关文章

产品应用7

谷歌 AI Studio 实时视频对话终于支持中文了!屏幕共享+语音,Gemini 2.5 Flash 原生音视频加持。

谷歌AI Studio实时视频对话支持中文,有Gemini 2.5 Flash原生视频对话模型。使用方便,还提供多种音色,有让模型在无声时发音视频等功能,可用于设计、学习、修电脑等场景。

AI进修生
算法论文7

Paper2Video:学术研究论文讲解视频自动生成

学术演示视频制作耗力,Show Lab提出Paper2Video基准数据集和PaperTalker多智能体框架,可从学术论文自动生成演示视频。还引入定制化评价指标,衡量学术演示视频效果。

带你学AI
开源动态8

国产AI视频炸了!SkyReels-V3三大功能重磅开源,1张图生成逼真视频

昆仑天工SkyworkAI团队开源多模态视频生成模型SkyReels-V3,它能在一个架构内搞定参考图像转视频视频延长、音频驱动虚拟形象三大核心能力,超越主流商业模型,且真正开源。

新智元
开源动态8

全新稀疏注意力优化!腾讯最新超轻量视频生成模型HunyuanVideo 1.5核心技术解密

腾讯混元大模型团队发布并开源轻量级视频生成模型HunyuanVideo 1.5,参数8.3B,支持5 - 10秒高清视频生成。它通过多层次技术创新,在生成效果、性能与尺寸上实现平衡,还具备多种核心能力。

量子位
新闻资讯7

The Batch: 937 |OpenAI 退出视频生成领域

OpenAI计划关闭视频生成器Sora,将资源重新分配到更有盈利性的投资中。Sora虽能生成高质量视频,但生成耗时久、计算成本高,日亏损约100万美元,其与迪士尼的合作也将结束。

DeeplearningAI
算法论文8

原来Veo 3早有苗头!人大联合值得买科技在CVPR 2025提出全新「图像到有声视频生成框架

中国人民大学与值得买科技团队在CVPR 2025提出JointDiT框架,可从静态图像生成同步音视频。此研究定义图像到有声视频生成新任务,解决音视频融合难题,实验显示其效果优,还将拓展至四模态建模。

机器之心
产品应用8

首个接入GPT-5的视频Agent!一句话生成商业级广告大片,分镜配音字幕等全包了

AI视频生成进入Agent时代,Video Ocean是首个接入GPT - 5的视频Agent,输入提示词就能自动完成分镜、画面等生成爆款视频。它有自动化创作生态系统,操作简单,新手也能上手。

量子位
开源动态8

音画同步视频生成重磅开源!Character AI和耶鲁大学推出Ovi,让音、画在一个大脑里思考

Character AI和耶鲁大学团队推出开源模型OVI,它采用双骨干交叉模态融合架构,让音视频同步生成。其架构对称,用旋转位置嵌入技术对齐时间,训练策略分步进行,生成效果佳,为开源音视频生成提供新路径。

AIGC开放社区
算法论文8

港中文薛天帆团队:实现 4K 全景视频生成,普通视频也能「长出空间」丨CVPR 2026

香港中文大学薛天帆团队提出CubeComposer框架,可将普通视角视频扩展成原生4K的360°视频。研究在两个数据集测试,结果显示其在多指标上优于基线。该成果突破技术上限,让普通人也能制作360°视频

AI科技评论
产品应用8

实测腾讯Hunyuan-Image2.0,首个毫秒级实时图像生成模型

今天上午腾讯发布混元图像2.0,以“更智能、更开放、更中国”为理念。其参数规模提升,推理时间大幅压缩,实现毫秒级实时生成,还在画面质量等方面升级,新增实时绘画板功能。

带你学AI