空间生成」共找到 2576 篇相关文章

开源动态8

昆仑万维开源的SkyReels-V3,把马斯克请来带货了

1月29日,Skywork AI团队宣布开源SkyReels - V3多模态视频生成模型系列,涵盖三大核心能力,达业界领先。经测试表现出色,其技术有创新,且模块化设计适配性强。昆仑万维此前在视频生成领域迭代快,此次开源或加剧竞争。

机器之心
开源动态8

一张图生成任意场景3D模型,部分遮挡也不怕|IDEA x 光影焕像联合开源

IDEA研究院张磊团队与香港科技大学谭平团队联合推出SceneMaker框架,以DINO - X与Triverse为基础,实现从任意开放世界图像到带Mesh的3D场景完整重建,解决遮挡难题,有多项创新,应用场景广泛。

量子位
开源动态8

加速200倍,单显卡1.8秒生成5秒高清视频!清华与Vidu解开了视频扩散模型的速度枷锁

清华、生数科技与伯克利联手用TurboDiffusion解开视频扩散模型速度枷锁。它改造注意力机制、引入步数蒸馏和量化策略,在多模型测试中加速100 - 205倍,且画质几乎无损。

AIGC开放社区
算法论文8

清华联手英伟达打造扩散模型新蒸馏范式!视频生成提速50倍,4步出片不穿模

清华大学朱军教授团队与NVIDIA Deep Imagination研究组联合提出分数正则化连续时间一致性模型(rCM),将连续时间一致性蒸馏扩展至大模型,解决现有方法瓶颈,提升推理速度兼顾质量与多样性。

量子位
开源动态8

“甲方快乐模型”诞生,拿下平面设计新SOTA!多条件一键生成,还能独立调整元素 | 复旦&字节

复旦大学和字节跳动团队联合提出CreatiDesign新模型,可实现高精度、多模态、可编辑的AI图形设计生成。它解决了以往方法在处理图形设计时的难题,在多维度评估基准上表现出色,还支持多轮编辑。

量子位
产品应用7

模力工场 027 周 AI 应用榜:从“一键生成”到“自动交付”,最会帮你干活的 AI 榜单来袭

模力工场第027周AI应用榜揭晓,上榜产品迈入新阶段,能接管关键环节。如Manus交付调研报告,秒哒将想法变应用,邀虾打通跨境电商流程。还介绍了上榜应用、趋势及上榜机制等。

AI前线
开源动态8

代码生成要变天了?被质疑架空后,Yann LeCun携320亿参数开源世界模型“杀回来了”

在新一代代码生成模型不断涌现的当下,Meta FAIR CodeGen团队由Yann LeCun领导发布了代码世界模型CWM。它有320亿参数,创新训练方式使它不仅会写代码,还能模拟执行,性能测试表现不俗,在圈内引发热议。

AI前线
算法论文8

Light-X来了!全球首个「镜头×光照」双控4D视频生成框架,单目视频秒变电影级

新加坡南洋理工大学等科研机构联合推出Light - X,全球首个「镜头×光照」双控4D视频生成框架。它解耦相机与光照,在扩散模型中融合,还构建Light - Syn数据管线,实验显示其效果显著优于现有方法。

机器之心
开源动态8

LeCun团队开源首个代码世界模型:能生成代码还能自测自修!传统编程模型一夜成古典

Meta FAIR推出全球首个代码世界模型CWM,它能生成代码、理解语义,还‘懂得’代码执行,能模拟运行过程。在多个代码与推理任务表现出色,开源代码、训练细节等,不过目前仅支持Python。

量子位
推荐文章8

10万引普林斯顿刘壮最新访谈:架构没那么重要,数据才是王道

普林斯顿大学助理教授刘壮在访谈中指出,架构没那么重要,数据、规模和记忆才是决定AI成败的关键。他认为ConvNet和Transformer性能差异源于训练细节;当前数据集远不够多样;大语言模型有语言空间的世界模型,但视觉空间的还缺失;记忆是瓶颈,智能体只是权宜之计;AI目前还替代不了研究生。

量子位