3D场景理解」共找到 4202 篇相关文章

算法论文7

Fable5仅做对3.5%!大模型会看图,但还没有主动视觉

本文介绍了专门测量「主动观察」能力的视觉推理基准 ActiveVision,评测显示无外部工具时,大模型与人类准确率有近 9 倍差距,用工具后虽提升但仍远不如人类,还说明了其出题与避免取巧的方式。

机器之心
开源动态8

无需多视角,单图重建可交互3D模型!南洋理工开源结构推理框架

南洋理工大学团队提出MonoArt,将单目可动物体重建建模为渐进式结构推理过程,通过四个关键模块逐步推理,无需外部先验,在PartNet - Mobility基准测试中表现领先,兼顾推理效率,还可用于下游任务。

新智元
开源动态8

Anthropic 黑客松冠军开源神作!3 万人收藏的神级 Claude Code 升级包!

Claude Code在处理复杂项目时存‘记性不好’等问题,单打独斗难敌复杂工程需求。Anthropic黑客松冠军得主开源Everything Claude Code项目,涵盖多模块,是系统化AI协作体系,已获30K+ Star。

开源星探
新闻资讯7

前OpenAI CTO企业遭重创!办公室偷情致团队崩盘,核心3人叛逃OpenAI

2026年1月,前OpenAI CTO Mira Murati创办的Thinking Machines Lab遭遇重创。联合创始人Barret Zoph因办公室恋情被降职后逼宫索权,遭拒被开除,随后与两名骨干叛逃OpenAI。这揭示了AI人才战争的残酷。

新智元
产品应用8

用了飞书aily新功能,我终于理解什么叫“AI不是聊天,是干活”

作者黄叔体验飞书 aily 工作助手的“任务模式”后赞不绝口。该模式能异步工作、深度结合飞书生态,可像数字员工一样交付多种成果,如竞品报告、网页、海报、播客等,虽有不足但非常实用。

AI产品黄叔
算法论文8

NTU S-Lab 团队探索可动 3D 新方向:结构、关节、纹理一次到位

南洋理工大学 S-Lab 团队发布研究,提出统一建模框架,能从单张图像生成可动三维对象,在几何精度、外观一致性与运动合理性上显著提升,解决了现有方法的难题,为相关领域发展奠定基础。

AI科技评论
7

谷歌杀入诺奖神殿,两年三冠五得主!世界TOP3重现贝尔实验室神话

2025年谷歌关联科学家再获诺贝尔物理学奖,使其两年内收获三项诺奖、五位得主。此前2024年已有三位相关科学家获奖。谷歌成继贝尔实验室与IBM后,最具「诺奖基因」的科技企业。

新智元
开源动态8

微软开源3大突破AI Agent模型,仅140亿参数超越DeepSeek-R1

微软研究院开源AI Agent推理模型rStar2-Agent,140亿参数在多测试超6710亿参数的DeepSeek-R1。其通过智能体强化学习,在训练基础、算法、流程上有三大突破,显著提升性能且降低算力成本。

AIGC开放社区
开源动态8

刷新复杂Agent推理记录!阿里通义开源网络智能体超越DeepSeek R1,Grok-3

互联网信息检索中,复杂问题让普通开源模型力不从心。阿里通义实验室提出WebSailor方案,通过SailorFog - QA数据集和DUPO算法等创新,提升模型能力,在多基准测试中超越诸多开闭源模型。

量子位
开源动态8

南洋理工 | 推出开源版MetaQuery:OpenUni,1.1B参数媲美BLIP3-o-8B

南洋理工大学 S-Lab 和商汤科技团队推出开源版 MetaQuery——OpenUni,仅 1.1B 参数就达 8B 模型性能。它架构极简、参数高效且完全开源,还采用两阶段训练策略,虽有局限但为多模态模型研究助力。

AINLPer