d - Matrix」共找到 361 篇相关文章

算法论文8

ICCV 2025 | HERMES:首个统一3D场景理解与生成的世界模型

本文介绍HERMES,首个统一3D场景理解与生成的世界模型。它由华中科技大学等团队合作研发,通过共享LLM驱动两大任务,解决了输入处理和任务融合难题,实验效果显著,为自动驾驶提供新范式。

机器之心
算法论文8

李飞飞又被超越了?百万「普通视频」打造通用4D世界模型!

全行业为昂贵多视角数据发愁时,中科院和CreateAI推出NeoVerse,用百万单目视频打开4D世界模型大门。它抛弃多视角数据和离线预处理,解决扩展性瓶颈,在重建速度、生成质量等方面表现出色,有丰富下游应用。

新智元
新闻资讯8

MIT给微型机器人做了颗芯片,功耗仅6毫瓦,能实时3D建图

麻省理工学院研究团队开发出名为 Gleanmer 的微型芯片,功耗仅 6 毫瓦,能实时生成三维占据地图。它解决了机器人导航核心问题,通过多项优化提升性能,或让小设备拥有空间理解能力。

DeepTech深科技
新闻资讯7

1600代码造出水下曼哈顿, Fable 5让Karpathy看呆了

Fable 5重新上线,Arena.ai的Gostev用其生成63个3D世界,多数一次成型,连Karpathy都直呼没想到。1600行代码就能撑起水下曼哈顿,还能将世界名画变成可穿行的3D世界,但游戏是其弱项。

新智元
新闻资讯7

李飞飞引爆的3D新技术,为什么这家深圳公司两年前就“玩腻”了?

李飞飞宣布可在任意设备流式传输超1亿个高斯泼溅,引发对3DGS的关注。其实深圳其域创新两年前就推出相关产品并开源。3DGS面临传输、加载和生态问题,现正从展示介质变为生产力工具,其域方案成底层支撑。

量子位
开源动态8

如何做到在手机上实时跑3D真人数字人?MNN-TaoAvatar开源了!

阿里巴巴淘宝Meta技术团队研发的TaoAvatar技术,能在手机或XR设备实现3D数字人实时渲染与AI对话。今日开源MNN - TaoAvatar应用,可在手机运行,对比主流方案更高效便捷,还介绍其优势、技术及使用说明。

机器之心
推荐文章7

长尾的复兴

作者曾认为3D打印在制造业是旁支末流,天花板低。如今看法转变,认为AI加3D打印将长尾从比特推进到原子,长尾社区也成熟,让小众需求有规模化满足可能,创客和业余爱好者迎来复兴。

乱翻书
新闻资讯7

对话赵天奇:从AI短剧到互动影游,聚力维度的“升维”之战

本文是对聚力维度创始人赵天奇的访谈。他认为 3D AI 技术潜力大,团队聚焦 AI 漫剧/短剧,用自研赛娲大模型降成本。还将拓展 3D 互动影游,认为它是游戏终极形态,从业者要回归影视本质,创业者需拥抱变化。

AI科技评论
新闻资讯8

工业异常检测新突破,复旦等多模态融合监测入选CVPR 2025

复旦大学等机构联合发布高精度多模态数据集Real - IAD D³,提出多模态融合检测方法D³M,成果被CVPR 2025收录。该数据集含多类数据,提升检测性能,此前相关工作也被CVPR 2024收录。

量子位
开源动态7

ICML25 | 让耳朵「看见」方向!仅依靠360°全景视频,就能生成3D空间音频

空间音频技术成提升沉浸式体验关键,但现有技术未充分利用360°全景视频空间信息。OmniAudio研究可直接从360°视频生成空间音频,相关代码和数据集已开源,虽有局限但前景好。

量子位