音视频处理」共找到 1876 篇相关文章

产品应用8

CapCut Mate:开源剪映自动化神器,让AI替你剪视频

CapCut Mate是开源免费的剪映草稿自动化助手,让开发者通过API控制剪映核心功能,效率提升超100倍。它功能丰富,覆盖剪辑全流程,适用于多场景,还提供三种使用方式。

小华同学ai
产品应用8

模型也能“freestyle”?可定制角色,模拟背景

阿里新推两款语模型,Fun - CosyVoice3.5可基于参考频克隆声,优化多方面能力;Fun - AudioGen - VD能进行‘从无到有’色设计,并模拟复杂听觉环境。用户即日起可在阿里云百炼调用。

千问Qwen
算法论文8

LeCun出手,造出视频世界模型,挑战英伟达COSMOS

训练有效世界模型面临数据、任务难度、算力消耗和评估等难题。Meta研究者提出通用视频世界模型DINO - world,可预测未来帧,在多方面有优势,实验显示其性能显著,能降低对标注数据需求。

机器之心
产品应用8

不止剪辑!剪映的未来是一站式AI视频平台

剪映产品负责人宣布,其野心是成为一站式AI成片的创意伙伴。今年对AI文字成片功能系统性升级,整合豆包、DeepSeek模型,新增多种功能,还推出剪小映应用,要打造一站式AI视频编辑平台。

量子位
新闻资讯7

倒反天罡:ChatGPT教人说话?36万视频+77万播客已证实!

最新研究警告,ChatGPT正改变英语表达方式,植入自身偏好。研究人员分析超36万视频和77万播客,发现GPT词汇使用率显著攀升。但研究有局限,且AI沟通还引发信任危机等问题。

新智元
新闻资讯8

Sora 2深夜来袭,OpenAI直接推出App,视频ChatGPT时刻到了

别家节前卷大模型时,OpenAI 悄悄发布 Sora2 并推出 App,还有配套视频推送算法防成瘾。Sora2 在物理准确性等方面优于以往系统,具备同步对话和效能力,Altman 称是 ChatGPT for creativity 时刻。

机器之心
开源动态8

阿里开源 Wan2.2-Animate!统一角色动画和视频人物替换

阿里通义实验室开源 Wan - Animate,这是用于角色动画与替换的统一框架。它构建于 Wan 模型之上,支持角色动画和角色替换两项核心功能,性能超现有算法,还通过独特设计实现多种效果。

带你学AI
产品应用8

一手实测全新的Sora 2 - AI视频的ChatGPT时刻到来了。

OpenAI发布Sora 2和Sora APP,Sora 2是视频频生成模型,在运动质量、人物表演、频生成等方面表现出色;Sora APP类似AI版抖,有社交互动“cameos”功能,但产品未来尚不明朗。

数字生命卡兹克
开源动态8

JSON 瑞士军刀,效率直接起飞!

现在很多接口、日志、配置文件用JSON,数据结构复杂时处理麻烦。`jq`是专门处理JSON的工具,支持格式化、过滤、提取等操作,语法简单,在多场景常见,安装方便。

开源先锋
新闻资讯8

让龙虾看懂屏幕!谷歌多模态新成果,文本图像视频频进同一空间

谷歌发布首个原生多模态嵌入模型Gemini Embedding 2,将文本、图像、视频频和文档映射进同一嵌入空间,支持多模态混合输入,为AI Agent“看懂”世界提供关键基础,已展开公测。

量子位