「通用视频生成模型」共找到 3280 篇相关文章
参编邀请 | 全国首部“AI生成内容合规”标准公开征集中,欢迎加入!
2026年8月2日欧盟《人工智能法案》透明度条款执法,全球AI生成内容合规监管进入硬约束时代。中国首个AI生成内容合规团体标准《人工智能生成内容合规管理指南》公开征集参编,亮点多、价值大。
银河通用王鹤:具身智能正迎来自己的 「AlphaGo」 和 「ChatGPT」时刻
银河通用创始人王鹤在2026年北京智源大会指出,具身智能正迎来“AlphaGo”和“ChatGPT”时刻。银河通用取得多项首创突破,其基座大模型“银河星脑”展示完整技术脉络,引领具身智能迈向通用未来。
破解空间智能数据稀缺难题,影石开源DiT架构全景生成模型,在线可玩
影石研究院团队推出基于DiT架构的全景图像生成模型DiT360,设计分层混合训练框架,结合透视与全景图像数据,提升真实感和几何一致性。它支持多任务,优于现有方法,为三维场景生成提供新思路。
通用Agent长啥样
视频探讨大厂做基于命令行编程工具的原因,介绍命令行Agent,剖析其等于庞大工具生态、经典Unix组合哲学与现代AI调度能力,指出通用Agent骨架由AI大脑、命令行身躯和MCP感官构成。
不要再拖拉拽了,利用n8n mcp直接生成n8n工作流
n8n是国外热门的AI应用编排工具,但用好它生成工作流并不容易。现介绍能生成n8n工作流的mcp,简单配置即可让AI生成工作流,其地址为https://github.com/czlonkowski/n8n - mcp。
HeyGen 开源了一个"用 HTML 写视频"的框架,我研究了一下,发现事情没那么简单
HeyGen 开源了 Hyperframes 项目,可让 AI 用 HTML 写视频。文章从其定义、上手教程、竞品对比等方面展开,指出它虽有短板,但代表视频制作新范式,建议相关从业者关注尝试。
不看后悔!GitHub 开源 MultiTalk .8k star 强大的人语音+图像绑定项目
MultiTalk 是 MeiGen‑AI 开发的开源框架,可从音频、图片和提示语生成多人对话视频。它解决传统视频制作痛点,功能亮点多,技术优势明显,应用场景广,与同类项目对比表现突出。
告别模板时代!妙多VP张昊然:生成式AI如何驱动UI设计的范式革命
在AICon2025上海站,妙多副总裁张昊然分享生成式AI在UI设计领域的影响。他回顾初代生成式UI的‘套模板’技术,讲述技术革新后回归代码生成界面,还探讨让AI理解设计系统、妙多AI 2.0理念及未来UI工具假设。
让AI当「动作导演」:腾讯混元动作大模型开源,听懂模糊指令,生成高质量3D角色动画
3D角色动画创作面临成本高、数据稀缺等问题。腾讯混元团队研发的混元Motion 1.0动作生成基础模型于2025年12月30日开源,通过全链路算法创新,为3D角色动画生成确立新技术范式。
SOTA级视频编辑新方法:无需训练一句话编辑视频,背景保持100%
传统视频编辑工作流被AI重塑,但现有AI方法存在问题,多源于反演 - 编辑范式。西湖大学AGILab提出无需反演和训练的FlowDirector,开销低、支持广且能100%保持背景,还采用新策略优化。