全身视频生成」共找到 2683 篇相关文章

算法论文8

合成数据≠生成模型:一文读懂合成数据的全新范式

最新研究提出合成数据全新分类框架,突破‘生成模型=合成数据’传统认知,涵盖多种方法。还按应用层次划分场景,指出合成数据面临模型坍塌等挑战,正成新型基础设施。

新智元
开源动态8

效果非常不错!阿里昨开源图形海报生成模型Qwen-Image

阿里昨日开源多模态图像基础模型Qwen-Image,基于20B参数MMDiT架构,在复杂文本渲染和精确图像编辑方面有重大突破,支持多风格图像生成、智能图像编辑等,还介绍了使用、部署等方法。

GitHubStore
新闻资讯7

Figure机器人分拣快递新视频曝光,网友:太像人类

Figure 02机器人开启打工模式,创始人放出其分拣快递新视频,它动作流畅像人类,由端到端通用控制模型Helix自主驱动。此前它还在宝马生产线连续20小时轮班作业,Figure与OpenAI分道扬镳后推出Helix。

量子位
开源动态7

一句话生成可上线的动效,这个项目真不错!

Github上的`Text-to-lottie`是开源Skill框架,可让Claude Code或Codex当动效设计师,按Lottie规范生成标准`lottie.json`。它有Coding Agent直出Lottie JSON、内置预览播放器等特色,助开发者快速产出合规Lottie资产。

开源先锋
产品应用8

实测LibTV团队版:AI视频的工作室时代来了!

作者实测LibTV团队版,分享用其制作皮克斯风格3D动画片段的过程,介绍团队版核心功能,如团队主体库、共享积分池、权限管理等,还提及新功能,指出AI视频走向工业化,而该团队版是首个专注团队协作的工具。

花叔
产品应用7

谷歌照片新增AI功能,可将不同风格照片变成视频

谷歌在官网宣布,谷歌照片推出新AI功能,可将照片转换为视频或重新混合成不同风格,如动漫、漫画等。操作简单,还推出新创建标签页集中工具,且添加水印和安全措施。

AIGC开放社区
开源动态8

腾讯重磅开源!端到端视频音效生成模型HunyuanVideo-Foley

腾讯混元正式开源端到端视频音效生成模型 HunyuanVideo-Foley,适用于多场景。它采用新型框架结合 REPA 策略,有三大核心优势,能适配多种场景,抑制底噪,保证音频保真度。

带你学AI
推荐文章7

AI 会生成 PPT 之后,Runtime 决定了它能做多好

作者回顾PPT Agent发展,指出存在Agent理解操作文档及AI生成PPT表达单一的问题。提出Artifact Runtime概念,它让PPT可被持续操作,还能接管重复决策,但不能替代专业判断。

phodal
产品应用7

狂肝一周,测评十余款 PPT AI 生成产品的真实反馈

评估 Agent 产品能力复杂,以 PPT 生成为例,有 Agent 和模板化两种流派。作者选前者投票测评、后者全方位测试。给出方案,还推荐不同需求适用产品,附总榜单和细致体验描述。

特工宇宙
算法论文8

让代码接管世界演化,西湖大学发布Code视频世界模型

西湖大学研究团队提出 Code World Model,将‘世界如何演化’和‘世界如何被看见’拆成两个互补问题,由 Coding Agent 决定世界演化,代码执行规则,视频模型转化为视觉观察,有应用潜力。

机器之心