可交互音视频」共找到 5013 篇相关文章

产品应用8

灵2.5 Turbo太凶残:30%成本暴降+效果飞跃,生成体操动作去参赛

快手推出灵2.5 Turbo视频生成模型,在力量感、滞空感和物理感知上进步明显。官方称其在文本响应、动态效果等维度效果提升,高品质模式成本降30%。不过,它在物理认知方面仍有欠缺。

量子位
产品应用8

Vidu Q2的参考生视频,是AI视频多参党的胜利。

作者分享使用Vidu Q2多图参考生视频的体验,认为它是AI视频多参党的胜利,是新工作流范式。Q2在一致性、表演能力和多风格表现力上大幅进化,价格实惠,还推出APP,多图参考生视频未来期。

数字生命卡兹克
算法论文8

如何判断AI视频真假?综述动态、溯源、解释的检测体系 | ACL26

AI视频生成技术发展迅速,现有检测方法难满足需求。最新综述提出「事实保真度验证」目标,梳理出视觉与语言双视角的四层检测框架,还分析了检测方法演进、评测指标和数据集,为AI视频检测提供落地地图。

新智元
算法论文8

机器人看视频学操作!伯克利首次打通互联网视频到灵巧手真机部署链路

UC Berkeley团队提出端到端流程,跑通从网络视频生成真实灵巧手实机执行轨迹链路。解决了单目RGB视频手-物交互重建、带噪声参考轨迹动作重定向及遥操作规模化难题。还给出数据筛选要点。

新智元
新闻资讯7

阿里HappyHorse开启灰测,720P视频生成低至0.44元/秒

4月27日,阿里巴巴视频生成模型HappyHorse 1.0开启灰测,全球专业创作者和企业级客户在官网和阿里云百炼平台注册使用,大众用户在千问App体验。官网720P视频生成刊例价0.9元/秒,专业会员包月叠加限时折扣后低至0.44元/秒。

AI前线
算法论文8

统一视觉多模态与多任务!快手灵与港科大团队发布视频生成模型,加速真实世界理解

港科大、港中文、清华和快手灵团队提出全新视觉框架UnityVideo,统一训练多种视觉模态,让模型更懂物理规律,视频生成更真实控,还实现零样本泛化,在多任务表现优异。

量子位
产品应用7

AI 互动游戏的 GPT 时刻到了!谷歌Genie 3首测!太牛了!

谷歌去年发布世界模型Genie 3,支持实时生成交互视频内容,因成本高未开放。现美国18岁以上Ultra用户试玩,其操控延迟低、画面清晰、物理交互真实,还介绍了操作流程等。

歸藏的AI工具箱
算法论文8

ECCV 2026 | 一段视频,重建一个仿真的动态世界

机器人走出实验室后,训练数据需覆盖真实世界情况。OVOW由多团队完成,被ECCV 2026接收。它从单目视频出发,输出编辑、碰撞的实例级Mesh,串联视觉基础模型完成流水线工作,能用于物理仿真。

机器之心
产品应用7

不是,微信视频号里现在也能召唤腾讯元宝了?。。。

现在视频号评论区用@召唤腾讯元宝。测试发现,它能总结视频内容、提取金句、总结脚本,还能总结菜谱。添加好友后就能使用,未来评论区或成共创聚集地。

数字生命卡兹克
产品应用7

视频博主别拿龙虾起号,7×24小时全自动,碳基生物真卷不过

X上网友分享的AIVideo Agent7×24小时全自动完成视频制作流程,上手无技术难度,还能与多平台集成。AIVideo.com功能全,实测生成速度快且操作空间大,或改写传统视频生产流程。

量子位