算法论文8
Adobe:VLM 不「喂」数据靠游戏变聪明
Founder Park
AI 摘要
Adobe 等团队研究提出「Vision-Zero」框架,让 VLM 像 AlphaGo 一样自我迭代。通过类似「谁是卧底」游戏训练,不依赖标注数据,在多任务表现超有标注方法,还缓解跨能力负迁移。
阅读原文 · Founder Park
Adobe 新研究:不用再「喂」训练数据,VLM 靠和自己玩游戏变聪明
Adobe 等机构研究人员提出「Vision-Zero」,借鉴 AlphaGo 自迭代方式,设计让 VLM 自我学习框架。此框架以类似「谁是卧底」游戏训练,不依赖标注数据,在多任务超越有标注的 SOTA 方法。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
算法论文8
浙大论文揭露VLM微调真相,给CLIP‘踩刹车’
浙大陈静远教授课题组等提出自适应非对称适配器,放弃对图像分支硬性微调,引入预测置信度自动给视觉塔‘踩刹车’。经实验总结出微调三大核心洞察,在多个数据集测试中表现优异。
AI科技评论
算法论文8
DOPD 破解「特权幻觉」,提升在线策略蒸馏效果
近期,新加坡国立大学等团队提出 DOPD 法解「特权幻觉」难题。该法依 token 情况动态蒸馏,实验表明其在 LLM、VLM 蒸馏效果好,鲁棒性强,训练稳定,为在线策略蒸馏提供新思路。
机器之心
算法论文8
论文:CNN仍是乳腺癌病理分类王者
哈萨克斯坦团队论文对比CNN和用LoRA微调的VLM在乳腺癌病理分类上的表现。指出VLM微调后接近CNN水平,但CNN仍是王者。还介绍LoRA原理、实验设计、结果,给出实战代码及对从业者和研究者的启示。
机器学习AI算法工程
算法论文8
Holi - Spatial打造400万级3D空间数据集
来自多机构的研究团队提出 Holi - Spatial,可从原始视频自动生成 3D 重建等数据,构建 400 万级空间标注数据集 Holi - Spatial - 4M,提升 VLM 空间能力,还形成自动化数据飞轮,但存在计算成本高、特定场景表现不佳等局限。
机器之心