算法论文8
清华&NTU:两张图重构3D空间新范式
量子位
AI 摘要
清华&NTU团队的LangScene-X以生成式框架,仅用2张图就能构建3D语言嵌入场景。它解决传统方法痛点,单模型统合多模态,在多数据集上表现优异,为空间智能带来新范式。
阅读原文 · 量子位
两张图就能重构3D空间?清华&NTU利用生成模型解锁空间智能新范式
ICCV 2025中稿的LangScene-X以全新生成式框架,仅用稀疏视图就能构建可泛化的3D语言嵌入场景。它攻克传统方法痛点,将多模态信息统一在单一模型,为空间智能领域打开新大门。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
新闻资讯7
李飞飞押注空间智能,破局之路在哪?
李飞飞押注的空间智能是世界模型主流路线之一,旨在让AI生成可操作三维世界。但当前AI生成世界存在“中看不中用”问题,构建“站得住”的世界面临速度与状态瓶颈,生境科技等实践提供了解决思路。
AI科技评论
开源动态8
影溯开源3D生成技术,Transformer进军三维世界
影溯将最新研究成果做成免费3D捕捉工具Crystal空间相机,背后技术QuerySplat已开源。其模型Topos - Lite改变组织三维空间方式,少量图片就能秒级生成3D场景,还能扩展容量。影溯团队经验丰富,技术应用场景广。
机器之心
算法论文8
NEO - ov:抛弃编码器的多模态大模型
南洋理工大学等团队推出NEO - ov模型,挑战传统「视觉编码器 + 大模型」范式,直接从原始像素学语言。它在多任务表现出色,尤其空间智能突出,但在OCR等方面有短板,展现原生多模态建模潜力。
机器之心
开源动态8
群核科技开源3D浏览器,性能超李飞飞团队
群核科技开源3D高斯浏览器Aholo Viewer,渲染速度和大场景加载性能超Spark2.0,能让任何设备浏览器流畅运行10亿+粒子的超大3D场景。它还带动信息载体范式跃迁,推动AI理解三维世界。
机器之心