3D生成榜单」共找到 3868 篇相关文章

开源动态8

分割一切、3D重建一切还不够,Meta开源SAM Audio分割一切声音

Meta 深夜放出音频分割模型 SAM Audio,可通过多模态提示分离任意声音。其核心 PE - AV 推动性能领先,还发布评测模型、基准等,整合进新平台,虽有局限但为音频 AI 带来新可能。

机器之心
算法论文8

一张照片,一个3D「你」:计算所等提出HumanLift,实现高保真数字人重建

中国科学院计算技术研究所等机构研究人员提出 HumanLift 技术,基于单张参考图像重建高斯网数字人全身。该技术融合三维视频扩散模型和人脸增强,仅需单张人体图片就能重建高逼真三维数字人。

机器之心
8

520,遇见国产「新模王」Qwen3.7-Max!

在2026阿里云峰会上,阿里推出全新一代千问旗舰模型Qwen3.7 - Max。它在各类测评中成绩亮眼,性能直逼全球最强模型,还针对Agent优化。阿里全栈AI体系助力模型高频迭代,千问深耕开源社区,志在成为智能体时代基础设施。

机器之心
新闻资讯8

GPT-5.3 Instant上线:ChatGPT终于不说教了

3月4日OpenAI更新GPT - 5.3 Instant,它重点优化为更准确、少尴尬,情商更高废话更少,联网搜索和写作能力增强,幻觉率降低。还提到GPT - 5.4已泄露,功能强大且将很快到来。

量子位
算法论文8

ICLR 2026 | ESC — 解构一步生成,厘清细节,探寻本质

西湖大学研究人员针对一步扩散生成模型复杂性问题,提出统一设计框架,对代表性模型进行组件级分析,定位关键误差来源,提出ESC变体,在ImageNet 256×256上取得优异成果。

机器之心
产品应用7

Gemini 的 PPT 生成:使用技巧及模板提示词

Gemini APP 上线 PPT 生成能力,可通过提示词精细控制,还能与谷歌产品打通。文章介绍其使用方法,如开启 Canvas 模式、利用搜索填充内容等,还分享百搭 PPT 风格提示词。

歸藏的AI工具箱
产品应用8

用“蒸汽机”生成视频,还能音视频一体化交付?

8月21日百度营销发布百度蒸汽机2.0,含多版本,有声版可音视频一体化交付。经测试,其生成视频细节佳、运动规律合理。它能解决影视业诸多痛点,成本低,还可免费使用。

AI产品黄叔
开源动态7

惊讶!!!3.2 万 Star OpenViking,让你的原地起飞!!!

OpenViking有3.2万Star,它把记忆、文档、提示词等上下文统一成可浏览地址空间,设计三层信息按需加载,检索留轨迹,还接入多种工具。不过它处Alpha阶段,用前要考虑许可证。

小华同学ai
开源动态8

无需多视角,单图重建可交互3D模型!南洋理工开源结构推理框架

南洋理工大学团队提出MonoArt,将单目可动物体重建建模为渐进式结构推理过程,通过四个关键模块逐步推理,无需外部先验,在PartNet - Mobility基准测试中表现领先,兼顾推理效率,还可用于下游任务。

新智元
开源动态8

开源AI教育视频生成神器,3Blue1Brown风教学动画一键搞定!

新加坡国立大学Show Lab团队开源Code2Video,能让代码变高质量教育视频,逻辑是用代码驱动视觉效果。它有智能解析等特性,可解决传统教学视频形式单一等问题,应用场景广泛。

开源星探