三维场景视频编辑」共找到 2805 篇相关文章

开源动态8

这款开源工具 deface,支持一键人脸打码,告别逐帧处理!

如今拍视频常出现路人,手动逐帧打码工作量大。开源工具 deface 可自动检测视频/图片中所有人脸,实现一键匿名化处理,还能处理摄像头实时画面,简单易用。

开源星探
开源动态8

最低仅需2G显存,谷歌开源端侧模型刷新竞技场纪录,原生支持图像视频

今天凌晨,谷歌官宣Gemma 3n,原生支持多模态。它在大模型竞技场超1300分,是首个超此分数的10B以下模型。其VRAM占用低,最低2GB,已在谷歌AI Studio等可用,还公开了技术细节。

量子位
产品应用7

月流水百万美元、跻身赛道前列,美图做出了视频版「美图秀秀」

美图旗下视频编辑产品 Wink 月流水超百万美元,MAU 在 770 - 900 万间波动。它靠变美和画质修复打出差异化,面向泛用户,在国内和东南亚市场增长好,采用订阅与内购配合的变现策略。

Founder Park
开源动态8

救命! Canvas?3.1k Star Mind Elixir ,真丝滑!!!!

Mind Elixir是可嵌入的JavaScript脑图内核,零依赖、框架无关。它能将JSON数据变成可交互节点,有拖拽、编辑等功能。适合知识库等场景,不适合只需不可编辑宣传图等场景

小华同学ai
产品应用8

AI世界名画复活走秀爆了,全网疯转!梵高达利莫奈同框谢幕,网友哭崩

国外ODDY工作室借助AI让世界名画及角色复活,打造超写实视频《名作艺术秀》。视频中梵高、达利等大师及作品化身“T台模特”,还有“幕后故事”,带来视觉盛宴,引发网友热议。

新智元
算法论文8

打破确定性魔咒!北航团队提出VBF++:用“不确定性建模”刷新多模态视频推荐 SOTA

北京航空航天大学和北京邮电大学联合提出VBF++框架,将多模态融合从“点估计”升级为“分布建模”。它由上下文感知先验、推荐引导的对抗优化和元学习三大组件构成,在多个数据集上刷新SOTA。

AI前线
新闻资讯7

AI 大牛刘威创业公司完成 5000 万美元融资,12 月将发布新模型

当地时间11月5日,刘威创立的Video Rebirth完成5000万美元种子轮融资,用于打造视频生成模型。公司计划12月发布Bach模型及AI视频生成平台,将与OpenAI Sora竞争,虽对手强大,但刘威认为小团队有机会。

AI前线
算法论文8

直接从像素到单词:这个原生大模型统一单图、多图、视频和空间智能

南洋理工大学等团队推出NEO - ov模型,挑战传统「视觉编码器 + 大模型」范式,直接从原始像素学语言。它在多任务表现出色,尤其空间智能突出,但在OCR等方面有短板,展现原生多模态建模潜力。

机器之心
新闻资讯7

2025年哪款模型最受欢迎?Poe最新报告:DeepSeek降温、可灵成黑马

AI工具聚合平台Poe发布2025年1 - 5月人工智能模型使用趋势报告。显示模型市场份额消长明显,推理模型势头正劲,图像、视频、音频生成领域各有竞争态势,如DeepSeek降温,可灵成视频生成黑马。

Founder Park
开源动态8

AI教母李飞飞空间智能开源大动作:上亿节点3D高斯场景塞进手机网页

AI教母李飞飞的空间智能公司World Labs开源3D高斯泼溅网络渲染器Spark 2.0,打破硬件与平台壁垒,将亿级渲染能力带到网页和移动端,解决Web端痛点,还采用三大核心技术系统及更多黑科技。

AI寒武纪