「空间重建」共找到 613 篇相关文章
老牌Transformer杀手在ICLR悄然更新:Mamba-3三大改进趋近设计完全体
Transformer架构仍是AI主流,Mamba作为挑战者影响力大。Mamba-3在ICLR 2026盲审,有梯形离散化、复数化状态空间模型、多输入多输出状态空间模型三大改进,实证表现佳,适合多场景。
Reasoning新突破:SoftCoT++如何让LLM‘多想几条路’?
LLM推理依赖‘思维链’,传统方法在离散token空间生成步骤有信息丢失、多样性不足问题。SoftCoT++在连续空间生成‘软思维’,拆分‘思考’与‘推理’,用专用初始token和对比学习,实验中全面超越传统方法。
让具身智能体拥有「空间感」!清华、北航联合提出类脑空间认知框架,导航、推理、做早餐样样精通
清华、北航联合提出类脑空间认知框架 BSC-Nav,让具身智能体有「空间感」。它克服现有导航方法记忆难题,有三大记忆组件,实验中性能碾压,能应对复杂任务,真机实测也表现出色。
欧洲黑马Mistral Medium 3来了!跑分对标最强Claude,实测大翻车
Mistral AI发布多模态模型Mistral Medium 3,官方称其性能接近Claude Sonnet 3.7且成本低,有诸多亮点。但网友实测结果不一,部分大佬认为性能不如官方宣传,建议别下载。
单目3DGS迎来突破:影石开源UniSHARP实现全相机适配
影石研究院发布单目新视角合成模型UniSHARP,可通过单次推理秒级获场景高斯点云,支持混合相机训练与免标定推理,适配所有相机。团队还构建数据集、设benchmark,代码等均已开源。
北大大牛团队最新顶会,首次让AI能够生成真实火焰
北京大学陈宝权教授团队提出 FieryGS 框架,被 AI 顶会 ICLR 2026 接收。它将多模态大模型、燃烧物理仿真与 3D 高斯溅射融合,首次在 3D 重建中实现物理可信、语义感知且可控的火焰合成,推动数字孪生发展。
0.9B跑出90%真机成功率!上海交大为VLA补上空间感
上海交大MINT团队提出中间路线Evo - Depth,约0.9B参数,不额外增硬件负担,兼顾仿真与真机性能及部署效率。系统由IDEM、SEM等组成,代码等已开源。
从拒绝AI到一切先问Agent,DHH:这是我最爽的编程时刻之一,但程序员黄金时代到头了
Ruby on Rails 作者 DHH 从拒绝 AI 到拥抱 Agent-First 编程工作流。他认为 Rails 因 token 效率或复兴,设计能力成核心竞争力,资深工程师更易从 AI 获益,程序员黄金时代或到头。他分享了使用 Agent 的体验和对行业的看法。
刚刚,Claude Mythos敲响末日警钟!超级智能已在悬崖,Hassabis深感恐惧
前沿AI已能自主攻击、逃逸,Anthropic因太危险暂不发布Claude Mythos Preview模型。谷歌DeepMind掌门人Hassabis、OpenAI CEO奥特曼均发出警告,虽恐惧AI风险却仍推进开发。
吴恩达来信:试试语音交互吧!
吴恩达认为基于语音、可对话的AI系统在发展,语音用户界面将普及。虽不会完全取代传统界面,但会带来新应用场景。还介绍了Vocal Bridge架构,且构建语音UI可能比想象容易。