正交子空间分解」共找到 1398 篇相关文章

算法论文8

BIGAI & 中科大团队提出 MILR: 测试时隐空间推理,让图像生成学会「边想边改」丨ICLR 2026

BIGAI与中科大等团队提出MILR,通过测试时隐空间推理,在不更新模型参数下优化图文表示,提升复杂图像生成能力。该方法在多基准测试达SOTA,还探讨了测试时扩展与奖励模型,未来有诸多拓展方向。

AI科技评论
算法论文8

用2D数据解锁3D世界:首个面向运动学部件分解的多视角视频扩散框架

张昊等提出 Stable Part Diffusion 4D (SP4D) 框架,由 Stability AI 与 UIUC 联合完成。它能从单目视频生成多视角 RGB 与运动学部件序列,解决运动学部件分解及自动 rigging 问题,实验效果显著,被 Neurips 2025 接受为 Spotlight。

机器之心
新闻资讯7

商汤王晓刚:世界模型将加快AI从数字空间进入物理世界,「悟能」想做那个桥梁

具身智能“大脑”成AI竞争焦点,“世界模型”或是通往“类人智能”的解法。商汤科技王晓刚认为世界模型将加快AI从数字空间进入物理世界,其推出的“悟能”具身智能平台想做这个桥梁,还谈到具身智能发展面临的问题与挑战。

机器之心
算法论文8

腾讯混元 x MBZUAI 港中文新研究:将纠错纳入策略空间,Search-R2 重构搜索增强推理学习方式

过去大语言模型能力提升靠参数和数据扩张,但在真实任务中此路径有局限。腾讯混元、MBZUAI、港中文联合团队提出Search - R2,将纠错纳入策略空间,抑制错误传播,在多跳推理任务中优势显著。

AI科技评论
产品应用7

我用扣子空间制作了档小宇宙播客《语出惊人》,借AI之口犀利对谈人生困境,效果惊艳

作者在All in AI后运营AI Reading Hub公众号,有每日文章和语出惊人两个板块。体验notebooklm后,用扣子空间制作小宇宙播客《语出惊人》,借AI探讨年轻人关注问题,后续会持续更新。

AI Reading Hub
开源动态7

ICML25 | 让耳朵「看见」方向!仅依靠360°全景视频,就能生成3D空间音频

空间音频技术成提升沉浸式体验关键,但现有技术未充分利用360°全景视频空间信息。OmniAudio研究可直接从360°视频生成空间音频,相关代码和数据集已开源,虽有局限但前景好。

量子位
新闻资讯8

别盯着GPU了,CPU成为AI时代的“新瓶颈”

进入2026年,AI系统性能越来越取决于执行与调度能力,CPU成为AI时代的“新瓶颈”。目前CPU市场供应紧张,英特尔、AMD、英伟达等大厂应对策略各有不同,智能体时代算力天平回摆。

芯师爷
算法论文8

10倍加速化学推理大模型!Haven团队在隐空间思考分子式,碾压显示CoT

Haven团队提出LatentChem,把化学推理从‘文本表面’挪到‘模型内部’,先在隐空间思考,再在语言空间回答。它拆分‘推理’与‘表达’,性能优异,为AI Scientist奠定基础。

量子位
新闻资讯8

李飞飞最新长文火爆硅谷

AI教母李飞飞发表长文,首次系统性解释空间智能,提出真具有空间智能的世界模型须具备生成、多模态、交互三个核心能力,还分享World Labs进展及世界模型在多领域的潜力。

量子位
算法论文8

NUS&复旦&清华:首个系统性大模型Latent Space综述

新加坡国立大学等多机构发布大模型潜在空间领域首个系统性全景综述,从“基础—演进—机制—能力—展望”拆解潜空间范式的底层逻辑、技术路径与未来前景,还对比了潜空间与显式空间差异。

PaperAgent