算法论文8
匹兹堡大学InfiniBench直击VLM空间推理软肋
量子位
AI 摘要
匹兹堡大学团队提出InfiniBench框架,已被CVPR2026接收。它用LLM Agent和聚类策略,能按需生成3D场景。实验表明,可精准定位VLM空间推理缺陷,为具身智能训练提供数据。
阅读原文 · 量子位
一句话生成无限逼真3D场景!匹兹堡大学新作直击VLM空间推理软肋丨CVPR'26
VLM在3D空间推理上表现不佳,且缺乏合适测试基准。匹兹堡大学团队提出InfiniBench框架,用LLM Agent迭代优化和聚类策略,可按需生成3D场景,还能精准定位大模型空间推理缺陷。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
算法论文8
浙大论文揭露VLM微调真相,给CLIP‘踩刹车’
浙大陈静远教授课题组等提出自适应非对称适配器,放弃对图像分支硬性微调,引入预测置信度自动给视觉塔‘踩刹车’。经实验总结出微调三大核心洞察,在多个数据集测试中表现优异。
AI科技评论
算法论文8
DOPD 破解「特权幻觉」,提升在线策略蒸馏效果
近期,新加坡国立大学等团队提出 DOPD 法解「特权幻觉」难题。该法依 token 情况动态蒸馏,实验表明其在 LLM、VLM 蒸馏效果好,鲁棒性强,训练稳定,为在线策略蒸馏提供新思路。
机器之心
算法论文8
上海交大和vivo:SSG让扩散模型生成更优
上海交大和vivo研究者提出自交换引导(SSG),不依赖文本条件、不加噪声、不改模型,只交换token特征。在多数据集实验中,SSG表现超现有方法。不过,其缺理论支撑、计算开销大。
量子位
算法论文8
论文:CNN仍是乳腺癌病理分类王者
哈萨克斯坦团队论文对比CNN和用LoRA微调的VLM在乳腺癌病理分类上的表现。指出VLM微调后接近CNN水平,但CNN仍是王者。还介绍LoRA原理、实验设计、结果,给出实战代码及对从业者和研究者的启示。
机器学习AI算法工程