「音视频智能」共找到 4246 篇相关文章
工行x上交大发布多智能体研究成果,通过群体智能刷新翻译新高度!
2025年多智能体系统成大模型研发新高地。工行大数据和人工智能实验室与上海交大人工智能学院推出多智能体翻译系统TACTIC,以认知翻译学为指导,在相同模型配置下提升翻译效果,在小模型下提升更明显。
号称视频编辑领域的开源nano banana来了,用文字就能改视频
DecartAI开源Lucy Edit模型,号称视频领域开源Nano Banana,能理解自然语言指令改视频。如输入指令可精准换服装等,渲染快,有身份保持和动态适配亮点,有多个版本,应用场景广。
Sora 模糊视频有救了!强大的免费开源AI视频处理工具!硬件要求低!
Video2X-QT6是免费开源AI视频处理工具,支持视频超清放大、补帧,兼容CPU和GPU,低配置电脑也能用。6.0.0版本用C/C++重写,速度快、跨平台,还能处理图片。介绍了不同系统安装方法等。
AI4S智能体「井喷」,这个智能体登顶多项评测榜单,实现产业落地
2026年是AI4S「智能体元年」,科研智能体产品密集发布,行业关注转向产品落地。深度原理发布的AI科学家平台Mira在多项评测中领先,其全链路闭环系统补齐传统短板,已在多领域落地验证。
10个视频9个看走眼:连真视频都打Sora水印碰瓷,这世界还能信啥?
互联网充斥AI造假视频,真假难辨,造成诸多困扰。虽有部门要求打水印,OpenAI也如此,但有人给真视频打Sora水印。现有AI检测工具各有局限,检测技术发展任重道远。
智能流体力学专题研讨会特邀报告1|潘翀:复杂流动智能测量方法——物理约束、数据同化与应用
2026年8月,第十四届全国流体力学学术会议在青岛举行。智能流体力学专题研讨会展示了AI与流体力学交叉研究进展。本次分享潘翀报告《复杂流动智能测量方法:物理约束、数据同化与应用》,含多种算法等内容。
还在为拍视频头疼?AI 一键生成短视频,这工具也太香了吧!
文章介绍开源工具 Pixelle-Video,它能让视频创作变得简单。输入主题,它可自动撰写文案、生成配图、合成语音、添加音乐并合成视频,还支持多种功能和大模型,有多种使用和付费方案。
ICML 2025 | 长视频理解新SOTA!蚂蚁&人大开源ViLAMP-7B,单卡可处理3小时视频
在视觉语言模型取得突破的当下,长视频理解挑战凸显。蚂蚁和人大团队提出视觉语言大模型ViLAMP,采用‘混合精度’策略,在多基准测试中超越现有方案,单卡可处理3小时视频,为实际应用带来新可能。
ACL'25 | 多智能体叛变进行中?首个多智能体安全守卫G-Safeguard亮相!
随着基于LLM的多智能体系统崛起,其安全隐患凸显。中国科学技术大学等机构提出G - Safeguard安全防护框架,它基于图神经网络,通过构建多智能体话语图等方式,能有效抑制恶意信息传播,有强大防御和泛化能力。
「一脑多形」圆桌:世界模型、空间智能在具身智能出现了哪些具体进展?|GAIR 2025
在第八届GAIR全球人工智能与机器人大会“数据&一脑多形”分论坛的圆桌论坛上,高飞、金鑫、王靖博三位学者围绕具身智能、空间智能、世界模型等话题展开讨论,探讨研究进展、挑战与机遇,还谈及创业和数据获取等问题。