可交互音视频」共找到 5020 篇相关文章

算法论文8

如何判断AI视频真假?综述动态、溯源、解释的检测体系 | ACL26

AI视频生成技术发展快,现有检测方法难满足需求。新综述提出‘事实保真度验证’目标,梳理四层检测框架,涵盖底层线索、时空一致性等,强调多层证据耦合与解释性,还分析评测指标与数据集。

新智元
新闻资讯7

2025年哪款模型最受欢迎?Poe最新报告:DeepSeek降温、灵成黑马

AI工具聚合平台Poe发布2025年1 - 5月人工智能模型使用趋势报告。显示模型市场份额消长明显,推理模型势头正劲,图像、视频、音频生成领域各有竞争态势,如DeepSeek降温,灵成视频生成黑马。

Founder Park
新闻资讯8

刚刚,谷歌摊牌:Genie 3让你1秒「进入」名画,人人交互世界!

谷歌新发布Genie 3世界模型,能从文本生成交互式AI空间世界,操控图像和视频。用户进入《苏格拉底之死》《夜游者》等名画探索,还能利用它训练3D模型,实现沉浸式体验。

新智元
8

估值200亿美元!灵AI被曝剥离快手单独融资

The Information爆料,快手计划分拆旗下视频生成模型灵AI,目标估值200亿美元并计划明年IPO。灵已开始盈利,在海外表现出色。快手拆分是因估值重构、资源压力和人才等三层压力。

量子位
开源动态8

数据减少超千倍,500 美金就训练一流视频模型,港城、华为Pusa来了

香港城市大学与华为香港研究所合作推出 Pusa 项目,它基于 FVDM 理论,极低成本微调大规模预训练视频模型,成本降超 200 倍、数据减少超 2500 倍,代码已开源。

机器之心
产品应用8

灵 2.1 首尾帧藏师傅外挂教程:两张图→大片,附万能提示词

作者分享灵 2.1 首尾帧模型测试与使用教程,解决图片和提示词生成难题。介绍三种拿图法,给出 AI 生成提示词方法及原则,还指出将流程固化、特效升维,提升视频创作效率与价值。

歸藏的AI工具箱
产品应用7

AI视频进入“加速度”时代:30%加速+细节随手P,等等党和抽卡党都有救了!

AI视频进入“加速度”时代,拍我AI(PixVerse)V5 Fast上线。其生成速度提升超30%,还推出Modify精修功能,支持万物替换、局部修改、人物编辑等,让AI视频从一次性生成走向反复打磨。

量子位
开源动态8

登顶全球权威榜单!浙大创业团队百卡打造开源实时世界模型,视频秒变交互4D世界

全球科技界正豪赌「世界模型」,但主流模型多停留在「视觉生成」。中国影溯公司发布并开源世界模型 InSpatio - World,综合性能优异,以小博大登顶权威榜单,降低了物理世界数字化门槛,引发行业关注。

机器之心
产品应用8

Sora2不够香了!这款国产AI视频模型已经能边看边生成,生成快还互动佳

国内AI视频玩家弯道超车,百度蒸汽机(文心专精版)开卷实时流式生成。它能边看边生成,生成快还互动佳,实现生成迅速、实时交互、无限续写,重新定义AI视频生成领域。

量子位
开源动态8

登顶行业SOTA的多模态视频生成标杆,昆仑天工刚给开源了

昆仑天工发布的多模态视频生成模型SkyReels-V3正式开源。它能文生视频、图生视频等,效果逼真。该模型针对现有AI视频问题实现多方面技术突破,且昆仑天工在模型和产品层面均有深厚积累。

量子位