视频超清放大」共找到 3019 篇相关文章

新闻资讯7

全球AI视频大战升级!「中国版Sora」Vidu Q2参考生月底发布,能力对标Sora 2

OpenAI的Sora 2引发全球AI视频狂欢,而国产AI视频Vidu将在本月底升级Vidu Q2参考生功能。Vidu起步更早、覆盖广,在一致性、运镜理解、动作连贯等维度优势明显,月底升级值得期待。

新智元
产品应用7

低延时、可交互的音频驱动肖像视频生成框架LLIA

美团提出新型音频驱动肖像视频生成框架LLIA,是低延迟、可实时交互的虚拟形象生成技术。它提出四项核心技术,引入三大核心模块,构建100小时数据集,在多方面有出色表现。

带你学AI
产品应用8

谷歌Veo 3魔性切水果刷屏全网!逼真视频狂吸10万粉,全体网友颅内高潮

谷歌AI视频工具Veo 3生成的解压切水果视频在全网病毒式传播,TikTok号主粉丝量猛涨。今天凌晨谷歌官宣其正式上线,网友热情高涨。此外,它还能实现多种创意视频生成,一位制作人用它两天做出3000万播放量广告。

新智元
产品应用8

Sora2不够香了!这款国产AI视频模型已经能边看边生成,生成快还互动佳

国内AI视频玩家弯道车,百度蒸汽机(文心专精版)开卷实时流式生成。它能边看边生成,生成快还互动佳,实现生成迅速、实时交互、无限续写,重新定义AI视频生成领域。

量子位
8

华师大智金院孵化金融原生基模Mint-Agent:越GPT-5.6与Claude Opus 4.8,商业订单已亿元

华东师大智金院团队孵化的金融原生基模 Mint - Agent 发布,在 FinanceAgentBench v2 上表现 GPT - 5.6 - Sol 与 Claude Opus 4.8,单题推理成本低,商业订单亿元,进入规模化金融场景验证阶段。

机器之心
算法论文8

仅看视频就能copy人类动作,宇树G1分分钟掌握100+,UC伯克利提出机器人训练新方式

UC伯克利团队研发出名为VideoMimic的新系统,能将视频动作迁移到真实机器人。它已让宇树G1模仿100多段人类动作,还能适应各种地形。其工作流程含视频转仿真、仿真训练策略、策略迁移到实体机器人。

量子位
算法论文8

V-RAE:把「看懂视频」的能力带入生成,重新思考视频模型的潜空间

近日,新加坡国立大学 Minghui Guo 与牛津大学 Shengqiong Wu、Hao Fei 在论文中提出视频表征自编码器 V-RAE。它以冻结的视觉基础模型为编码器压缩视频特征,还引入轻量级模块聚合信息。经实验验证,其在视频生成和预测上性能出色。

机器之心
开源动态8

阿里开源 Wan2.2-Animate!统一角色动画和视频人物替换

阿里通义实验室开源 Wan - Animate,这是用于角色动画与替换的统一框架。它构建于 Wan 模型之上,支持角色动画和角色替换两项核心功能,性能现有算法,还通过独特设计实现多种效果。

带你学AI
开源动态8

牛!小米开源「音频语言模型」,1亿小时预训练时间,音频理解和输出能力是真顶!

小米推出开源音频语言模型MiMo - Audio,有1亿小时预训练时间。它能理解音频,70亿参数模型在多基准测试达SOTA,音频理解Gemini - 2.5 - Flash,复杂推理优于GPT - 4o - Audio,还支持多模态任务。

开源AI项目落地
新闻资讯7

独家|拿下5亿元海外订单,无界动力完成天使++轮融资,天使轮累计融资2亿美元

AI科技评论独家获悉,通用具身智能机器人公司无界动力完成天使++轮融资,累计2亿美元,天使+++轮也接近完成。其以隐空间世界模型构建具身大脑,区别于主流架构。还获远景5亿订单,商业化落地成果多。

AI科技评论