视频分镜」共找到 1565 篇相关文章

开源动态7

SGLang|SGLang Diffusion

来自SGLang开源社区的Yichi介绍SGLang Diffusion,它是面向图像与视频生成的全开源扩散模型推理引擎。基于SGLang机制将能力迁移到扩散模型推理,能显著提速工作流,视频展示了多种功能。

GiantPandaLLM
产品应用7

比修驴蹄还魔性!谷歌这7段纸片动画,看完焦虑没了,第2支直接封神

全球网友爱刷解压视频,谷歌Gemini下场做带提示词的解压视频。它推出7段纸艺动画,包括火烈鸟起舞、圣托里尼落日等,靠高精准提示生成等打造,拓展想象边界,是通往美学与治愈的桥梁。

新智元
开源动态8

这款开源工具 deface,支持一键人脸打码,告别逐帧处理!

如今拍视频常出现路人,手动逐帧打码工作量大。开源工具 deface 可自动检测视频/图片中所有人脸,实现一键匿名化处理,还能处理摄像头实时画面,简单易用。

开源星探
开源动态8

最低仅需2G显存,谷歌开源端侧模型刷新竞技场纪录,原生支持图像视频

今天凌晨,谷歌官宣Gemma 3n,原生支持多模态。它在大模型竞技场超1300,是首个超此数的10B以下模型。其VRAM占用低,最低2GB,已在谷歌AI Studio等可用,还公开了技术细节。

量子位
产品应用7

月流水百万美元、跻身赛道前列,美图做出了视频版「美图秀秀」

美图旗下视频编辑产品 Wink 月流水超百万美元,MAU 在 770 - 900 万间波动。它靠变美和画质修复打出差异化,面向泛用户,在国内和东南亚市场增长好,采用订阅与内购配合的变现策略。

Founder Park
产品应用8

一个APP就能拍短片!人物、字幕、BGM……AI Agent统统自己搞定

剪映旗下内容创作Agent小云雀上线新功能,可文生数字人,还能根据提示词生成视频。它有“参考图生视频”玩法,能解决图片混剪难题。依托字节模型,创作门槛低,交付质量高,限时免费。

量子位
算法论文8

新SoTA方法RM-R1:让reward model对评说出原因!超越GPT4o

过去模型‘黑箱打’不透明、不灵活。论文提出ReasRM,经两阶段训练,让奖励模型像人类先思考再打。它能任务类型、动态奖励,实验中碾压GPT - 4,小模型逆袭,团队已开源6个模型。

深度学习自然语言处理
产品应用8

AI世界名画复活走秀爆了,全网疯转!梵高达利莫奈同框谢幕,网友哭崩

国外ODDY工作室借助AI让世界名画及角色复活,打造超写实视频《名作艺术秀》。视频中梵高、达利等大师及作品化身“T台模特”,还有“幕后故事”,带来视觉盛宴,引发网友热议。

新智元
算法论文8

打破确定性魔咒!北航团队提出VBF++:用“不确定性建模”刷新多模态视频推荐 SOTA

北京航空航天大学和北京邮电大学联合提出VBF++框架,将多模态融合从“点估计”升级为“布建模”。它由上下文感知先验、推荐引导的对抗优化和元学习三大组件构成,在多个数据集上刷新SOTA。

AI前线
推荐文章8

最新AI眼格局报告:百大战拉开序幕,阿里DeepSeek高通成幕后赢家

量子位智库推出《AI眼「预选赛」格局报告》,析AI眼市场。从产品到技术,如大模型通义千问、DeepSeek成赢家,高通骁龙AR1受青睐,还探讨了各类型AI眼趋势、玩家构成等。

量子位