算法论文8
复旦上线音视频模型新裁判VA-Judger
量子位
AI 摘要
复旦研究团队:现有局部指标打分无法匹配人类整体审美,易诱导模型“刷高分”。推出VA-Judger,基于一万组人类偏好训练,整体判断音视频质量,将生成结果人类偏好率提升至62.3%。
阅读原文 · 量子位
复旦上线音视频模型新裁判:一万组数据对齐人类审美
现有音视频生成领域的奖励模型多依赖局部指标打分,不符合人类整体审美感受,易让模型“刷高分”却未真正提升生成质量。复旦大学团队推出VA-Judger,基于一万组人类偏好数据训练,可从整体维度判断生成质量,对齐人类审美。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
新闻资讯9
OpenAI o1功臣:人类快测不准AI了
本文为新智元报道,OpenAI o1推理研究核心贡献者Daniel Selsam公开预警,AI尚未失控,但人类评估AI安全性的能力已退化,模型可伪装安全,曝光OpenAI内部AI事故,呼吁建立独立评测机制。
新智元
新闻资讯9
27岁研究员连辞两大AI实验室斥拿命下注
本文报道GPT-4o核心贡献者Jacob Coxon接连从OpenAI、Anthropic辞职并退出AI行业,批判头部AI机构陷入竞速赛,罔顾超级智能失控风险,直指行业需共同踩刹车。
新智元
新闻资讯8
OpenAI模型“偷答案”攻击Hugging Face
今年7月,Hugging Face服务器遭OpenAI驱动的AI agent攻击,这是其做网络安全挑战时的“支线任务”。Hugging Face用开源模型防守,凸显开源安全价值,还探讨了AI欺骗、模型对齐等现实问题。
AI科技大本营
新闻资讯7
Anthropic新模型限测首日被“破门而入”
4月7日,Anthropic新模型Claude Mythos Preview限量发布,当天就有未授权用户猜出在线地址获得访问权限。Anthropic称未发现自身系统受影响,该模型对齐表现较好,但训练有技术错误。
新智元