「三维生成框架」共找到 3512 篇相关文章
10秒视频token超5万,O(n²)跑不动?用后训练线性化框架实现1.71倍加速,推理成本大降|CVPR'2026
视频生成进入大规模时代,但计算成本高,自注意力复杂度O(n²)跑不动。研究团队提出LINVIDEO后训练框架,无需数据和重新预训练,实现视频扩散模型线性化替换,保持生成质量,加速推理并降低成本。
AI生成视频总不符合物理规律?匹兹堡大学团队新作PhyT2V:不重训练模型也能让物理真实度狂飙2.3倍!
匹兹堡大学团队提出 PhyT2V 框架,论文已被 CVPR 2025 接收。该框架不依赖重训练或大量外部数据,通过链式推理与迭代修正机制,增强主流 T2V 模型物理场景泛化与生成能力,应用前景广。
打破具身世界模型可执行性鸿沟 !港中深-跨维智能团队提出EVA框架,用强化学习让视频世界模型真正“动”起来
近期,利用视频生成模型为机器人构建“世界模型”成热门路线,但存在“可执行性鸿沟”。港中深 - 跨维智能团队提出 EVA 框架,用强化学习优化视频生成,实验显示其能提升视觉规划、仿真任务成功率及真实部署稳定性,还有数据合成潜力。
Svelte 团队成员开源新框架 Ripple,又一个想“改写前端”的框架?
Ripple是全新开源前端框架,由Svelte核心维护者打造,融合多框架理念,采用TS优先设计,有细粒度响应式机制等,目标是带来更简单开发体验,团队还探索集成AI能力,目前处于早期阶段。
智能体框架的选择:一文读懂9个主流AI智能体框架
文章深入探索截至2025年11月的9个主流AI智能体框架,阐述成熟AI框架核心要素,分析各框架优劣势、适用场景,助读者选适合团队和业务的框架。
天下苦VAE久矣:阿里高德提出像素空间生成模型训练范式, 彻底告别VAE依赖
当前主流图像生成技术训练范式依赖VAE,带来训练复杂、微调成本高的问题。阿里高德提出EPG,结合自监督预训练与端到端微调,去除对VAE依赖,在训练效率和生成效果上有突破。
实时生成视频!StreamDiT每秒16帧,单卡生成
现有文本生成视频模型多为离线生成,无法满足实时交互需求。加利福尼亚大学与Meta联合提出StreamDiT模型,采用流匹配等方法,蒸馏模型可单卡每秒16帧实时生成512p视频,不过仍有伪影问题。
生成率从8%到60%:快手智能测试用例生成系统的四阶进化
快手研发效能团队构建智能用例生成系统,实现从手动编写到审核校验的模式转变。该系统历经四阶架构演进,将用例生成率从 8% 提升至 60% 以上,成为公司测试人员日常使用的标准化生产力工具。
腾讯混元AI开源3D世界生成模型!文图即可生成3D沉浸式场景!
腾讯混元AI实验室开源HunyuanWorld 1.0,这是业界首个支持沉浸式、探索性和交互性3D世界生成的全开源模型。它能通过文图生成3D场景,为多领域提供支撑,还给出安装和代码使用示例。
季度AI视频生成产品:多模态输入成标配,角逐一站式生成能力 | 量子位智库AI 100
Sora2下载量破百万引发AI视频生成热潮,谷歌推出Veo3.1再掀高潮。国外大厂将其卷至电影制作级创意,国内企业追求高质量、秒级生成并落地垂直场景。量子位智库发布的产品呈现多维度技术演进。