数字人视频」共找到 2219 篇相关文章

算法论文7

InfiniteTalk:音频驱动的从口型到全身动作同步方法

近年来视频AIGC推动音频驱动体动画变革,但传统视频配音局限口部。中国科学院大学提出稀疏帧视频配音范式,推出InfiniteTalk生成器,结合多种技术实现全身动作与音频同步,实验表现突出。

带你学AI
新闻资讯8

Runway深夜炸场:一口气发布5大更新,首个通用世界模型来了

主攻AI视频与多媒体生成技术的独角兽Runway发布5大更新,包括旗舰视频生成模型Gen - 4.5、首个通用世界模型GWM - 1等,展示了其在通用世界模型上的野心,刷新了视频生成指标。

机器之心
开源动态7

Wan2.2-Animate又火了,5分钟让抠脚大汉秒变高冷女神。

阿里开源模型Wan2.2 Animate又火了,用照片和视频就能生成换脸视频,表情动作复刻佳。它上限高,还能变声,可用于舞蹈视频、影视二创等,但手指易崩坏。模型开源,有积极意义也有风险。

数字生命卡兹克
开源动态8

终于!世界模型进入“有声时代”:24FPS画面+48kHz立体声实时生成

过去两年视频生成模型不断提升画面参数,但传统模型生成的视频固定,用户无法干预。而世界模型可跟随操作实时渲染、动态生成世界。目前Noiz AI联合多机构发布实时可交互音视频世界模型HelixWorld 1.0,后续还将开源。

量子位
新闻资讯7

在上海!邀你踏入“未来分身术”的沉浸世界

2025年9月26日14:00,MANA在上海the point空间邀你体验“未来分身术”。艺术家赵博雄会带来“分身术”艺术实验,还介绍了数字艺术分身术在公共文化、演出等方面的价值及活动流程和参与方式。

MANA新媒体艺术站
产品应用8

谷歌Veo 3.1更新:更一致性、更具创造力和控制力

谷歌Veo 3.1发布更新,实现角色、背景与物体在动态场景中的高度一致性,支持基于参考图片创建视频、原生竖屏模式及1080p和4K分辨率升频,精准控制素材,提升创作体验。

AIGC开放社区
新闻资讯8

陶哲轩在线安利Claude Code:审稿意见全给它,15分钟欧了

科研投稿论文常被审稿“折磨”,陶哲轩用Claude Code修改论文,15分钟搞定,还捉出审稿错误。他认为应让AI干脏活累活,类解决难题,AI+成数学界新趋势。

量子位
新闻资讯7

18岁OpenClaw版AI女友一夜爆红,全网60万围观!00后开发者一造出

基于OpenClaw打造的韩国AI女友Clawra上线爆火,60多万围观。她有完整设,亮点诸多,项目还开源。此外,还有Aniclaw等类似项目,OpenClaw掀起热潮,智能体生态蓬勃发展。

新智元
新闻资讯8

英伟达让机器「做梦学习」,靠梦境实现真·从0泛化

英伟达推出DreamGen项目,让机器‘做梦学习’。它利用视频世界模型生成神经轨迹,仅少量现实视频就能让机器学会新任务,实现从0泛化,还将助力GR00T - Dreams发展。

量子位
新闻资讯8

AI形机器+智能可穿戴时装大秀!领略东方语境下的未来机美学

2025年濮院时装周上,数字艺术家余一萌携手众擎机器带来《器生幻形》机器时装秀。以数字孪生为核心,展示服装虚拟与现实一体化设计。大秀融合多元元素,为未来机协同时尚打开想象空间。

MANA新媒体艺术站