算法论文8
GVE模型:155万视频练就9种检索技能
量子位
AI 摘要
香港科技大学(广州)与阿里巴巴通义实验室合作,推出GVE模型。它用155万模拟视频训练,一次学会9种视频检索技能,在零样本下超越14个主流模型,为视频检索通用化提供方法论。
阅读原文 · 量子位
用155万模拟视频给模型上课!GVE模型一次学会9种视频检索技能
当前视频检索研究陷入困境,现有模型难以应对复杂检索需求。香港科技大学(广州)联合阿里巴巴通义实验室推出通用视频嵌入模型GVE,其在零样本设置下超越14个主流模型,全链条创新为视频检索通用化奠定基础。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
算法论文8
吴恩达:丢弃推理token可提速3倍
吴恩达新作Prefix Sliding指出,模型推理时丢弃中间已贬值token,只保留前缀+滑动窗口,无需训练可提速3倍,配合RL训练能将推理轨迹扩展到10万token以上。该方法为Agent场景提供新思路。
PaperAgent
算法论文7
UniSteer:人类指导让 VLA 强化学习更高效
视觉 - 语言 - 动作模型(VLA)是机器人操作重要基础模型,但复杂任务成功率低,真机强化学习成本高。微软等机构研究者提出 UniSteer,将人类纠正转换成噪声监督,在多任务测试中提升了成功率。
机器之心
算法论文8
ClawBench:AI agent真实网站任务集体翻车
ClawBench让AI在144个真实网站执行153个日常任务,结果惨烈,如Claude Sonnet 4.6每三任务翻车两个,GPT - 5.4仅完成10个。它还揭示AI在真实环境的问题,为评估模型提供标尺。
机器之心
算法论文8
颜见智团队:启发学习让大模型自我进化
当下大模型能力多靠人为框架,能力上限受限。文章提出“启发学习”,将其集成到推理侧成Isaac框架,通过Prompt与网络层注入复用旧经验,实验显示能大幅提升大模型任务性能。
机器之心