3D场景理解」共找到 4174 篇相关文章

产品应用8

OpenAI点赞转发的冠军项目,背后藏着一个国人3D生成团队

近日,iOS产品StoryWorld获OpenAI Codex Hackathon冠军,其核心3D资产生成用了DeemosTech的Hyper3D Rodin。从黑客松到英伟达工程场景3D生成重稳定性等特性。Hyper3D团队技术强,发布编辑功能,推动3D生成走向可控。

机器之心
算法论文8

3D重建的惊人进展:多所世界名校联合发布论文,告诉你AI在3D世界的研究现状

多所世界名校联合发布调查研究论文,回顾用于3D重建和视图合成的前馈技术并分类,研究关键任务及应用。前馈模型打破每场景优化魔咒,带来速度和泛化能力的提升,解锁新应用,但也面临挑战。

AIGC开放社区
算法论文8

公里级场景也能稳住了,国产团队把长视频3D重建又往前推了一步

浙江大学、地平线机器人和之江实验室的新工作 Scal3R 要解决长视频 3D 重建问题。它借助 test - time training 技术,设计全局上下文模块和同步机制,提升长序列重建稳定性和精度,能处理超万帧几千米的场景

机器之心
开源动态8

Meta 悄悄开源了两个惊艳的 3D 重建模型,物体重建+人体重建!

前两天AI圈被Gemini 3 Pro刷屏,Meta却悄悄开源了两个“硬核”项目:SAM 3D Objects可从一张照片重建任意物体,SAM 3D Body能从一张照片重建人体网格模型,二者结合可构建完整3D场景,且全部开源、可商用。

开源星探
算法论文7

3D-R1重塑三维视觉语言推理!让三维交互更智能

近年来,视觉 - 语言模型在2D图像理解有突破,但3D视觉语言模型面对复杂场景不足。为此上海大学团队提出3D - R1模型,它基于新数据集和策略构建,有强多任务三维理解能力,不过也存在进步空间。

带你学AI
算法论文8

ACMMM 2025 | 北大团队提出 InteractMove:3D场景中人与可移动物体交互动作生成新框架

北大团队在ACMMM 2025发布InteractMove,首次提出含可移动物体3D场景中基于文本的人 - 物交互生成任务,构建数据集与创新框架,在多指标领先,代码与模型已开源。

机器之心
产品应用7

DeepSeek有点含蓄了,实测V3.1有进步,编程等个别场景硬刚GPT-5

DeepSeek悄悄更新V3.1,官方仅提及上下文长度拓展至128K。实测其代码能力与前端审美提升,逻辑推理也有进步,在编程等个别场景能硬刚GPT - 5,但处理复杂任务还有距离,更新不大却有进步且降价。

鲸选AI
开源动态8

百度开源视觉理解模型Qianfan-VL!全尺寸领域增强+全自研芯片计算

今天百度智能云千帆推出全新视觉理解模型Qianfan - VL并全面开源,含3B、8B和70B三个版本,基于自研昆仑芯P800计算。它特点多、性能优,应用场景广,未来还将推新产业级模型。

量子位
新闻资讯8

ARR达到3亿美金,Liblib完成近3亿美金融资,估值超20亿美金

近期,演语科技B+轮融资近3亿美元,估值超20亿美元。其ARR达3亿美金,多方面领先同行。该公司跑通PMF,旗下产品有自发传播、用户付费、专业机构接入等优势,LibTV靠系统编排能力切入高价值场景,还筑起生态壁垒。

机器之心
算法论文8

RL加持的3D生成时代来了!首个「R1 式」文本到3D推理大模型AR3D-R1登场

强化学习首次被系统性拓展到文本到3D生成领域,上海人工智能实验室等机构研究者提出首个强化学习增强的文本到3D自回归模型AR3D - R1,还提出Hi - GRPO范式和MME - 3DR基准,实验显示其性能优异。

机器之心