算法论文8
浙大论文揭露VLM微调真相,给CLIP‘踩刹车’
AI科技评论
AI 摘要
浙大团队:VLM微调存在矛盾,图像编码器微调过度会破坏泛化能力。提出自适应非对称适配器,按置信度给视觉塔‘踩刹车’,在多数据集测试中领先,为少样本场景落地提供解法。
阅读原文 · AI科技评论
别再乱调图像塔了!浙大 IJCAI 论文揭露 VLM 非对称性真相,给 CLIP 微调「踩刹车」
浙大陈静远教授课题组等提出自适应非对称适配器,放弃对图像分支硬性微调,引入预测置信度自动给视觉塔‘踩刹车’。经实验总结出微调三大核心洞察,在多个数据集测试中表现优异。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
推荐文章8
机器人泰斗:后空翻是杂耍,端咖啡才是真AI
在最新一期播客中,机器人学泰斗 Sergey Levine 与 Ryan Peterman 深度对话,触及行业焦点如机器人发展阶段、波士顿动力淡出原因等。他强调,机器人技术尚处底层搭建期,需重视先验知识、软硬件结合,跨越鲁棒性门槛。
AI科技大本营
新闻资讯7
黄仁勋等投资的Generalist机器人潜力大
Generalist是专注给机器人“造通用大脑”的AI公司,创立不久便多次融资,估值超20亿美元。其GEN - 1.5有强大泛化能力,演示一次就能上手,但也有很大进步空间,展示了未来通用机器人大脑学习方式。
量子位
新闻资讯8
Altman力荐:AI幕后大神Alec Radford
2026年7月28日,Altman在播客推Alec Radford至台前,称其为领域重要却鲜为人知的研究者。他主导GPT、CLIP、Whisper等研发,为AI发展贡献大。2024年他离开OpenAI,此后发布Talkie,持续探索模型能力来源。
DeepTech深科技
算法论文8
DOPD 破解「特权幻觉」,提升在线策略蒸馏效果
近期,新加坡国立大学等团队提出 DOPD 法解「特权幻觉」难题。该法依 token 情况动态蒸馏,实验表明其在 LLM、VLM 蒸馏效果好,鲁棒性强,训练稳定,为在线策略蒸馏提供新思路。
机器之心