素材生视频」共找到 1079 篇相关文章

算法论文8

视频世界模型跑长序列不「崩」了!用光流约束+历史记忆+多步训练,让动态场景稳如磐石

现有视频世界模型在长时间交互中易出现运动不合理与场景崩坏问题,核心原因是误差累积。MagicWorld提出面向长时稳定性的交互式建模框架,通过光流约束、历史缓存检索和多步聚合训练,有效缓解误差累积。

量子位
算法论文8

AI视频总不符合物理规律?匹兹堡大学团队新作PhyT2V:不重训练模型也能让物理真实度狂飙2.3倍!

匹兹堡大学团队提出 PhyT2V 框架,论文已被 CVPR 2025 接收。该框架不依赖重训练或大量外部数据,通过链式推理与迭代修正机制,增强主流 T2V 模型物理场景泛化与成能力,应用前景广。

机器之心
新闻资讯7

腾讯回应 OpenClaw 之父 Peter 的“抄袭”指责;突发!字节AI视频模型Seedance 2.0发布紧急叫停;Mac mini因“养虾热”断货 | Q资讯

本周AI圈热点不断:腾讯回应OpenClaw之父“抄袭”指责;字节AI视频模型Seedance 2.0发布叫停;Meta或裁员20%;美团王兴谈海外战略与AI冲击;“养虾热”致Mac mini断货;DeepSeek V4和腾讯新混元模型4月将发布。

InfoQ
开源动态7

AI 剪辑杀器 CutClaw 开源了!再也不用手动卡点了!

CutClaw是面向长视频与音乐的端到端自动剪辑系统,可自动解析素材,按文字指令成踩点短片,部署简单,有短期和长期目标,也给出运行慢的原因与优化建议。

GitHubStore
算法论文8

让AI作画自己纠错!随机丢模块就能提升成质量,告别塑料感废片

来自清华、阿里等的团队推出S² - Guidance方法,通过随机丢弃网络模块动态构建子网络实现自我修正。它避免了其他方法繁琐调参,在文图和文视频任务中显著提升成质量与连贯性,且计算高效。

量子位
算法论文8

通向世界模型关键一步:EX-4D来了,实现单目视频到自由视角

去年Sora等模型革新视频成领域,相机可控的视频成技术是构建世界模型核心。但从单视角成极端视角视频是难题,PICO - MR团队提出EX - 4D,能从单目视频成新视角视频,多方面表现出色。

机器之心
开源动态8

腾讯混元开源游戏AI成新工具!RTX 4090就能制作3A级动态内容

腾讯开源游戏视频成框架Hunyuan - GameCraft,基于混元视频成搭建,操作简单,输入单张场景图、文字描述和动作指令就能成高清动态游戏视频,解决传统工具瓶颈,性能优于主流模型。

量子位
算法论文7

InfiniteTalk:音频驱动的从口型到全身动作同步方法

近年来视频AIGC推动音频驱动人体动画变革,但传统视频配音局限口部。中国科学院大学提出稀疏帧视频配音范式,推出InfiniteTalk成器,结合多种技术实现全身动作与音频同步,实验表现突出。

带你学AI
新闻资讯8

Runway深夜炸场:一口气发布5大更新,首个通用世界模型来了

主攻AI视频与多媒体成技术的独角兽Runway发布5大更新,包括旗舰视频成模型Gen - 4.5、首个通用世界模型GWM - 1等,展示了其在通用世界模型上的野心,刷新了视频成指标。

机器之心
开源动态7

Wan2.2-Animate又火了,5分钟让抠脚大汉秒变高冷女神。

阿里开源模型Wan2.2 Animate又火了,用照片和视频就能成换脸视频,表情动作复刻佳。它上限高,还能变声,可用于舞蹈视频、影视二创等,但手指易崩坏。模型开源,有积极意义也有风险。

数字生命卡兹克