新闻资讯7
Lun Wang:评估是模型能力飞跃瓶颈
机器之心
AI 摘要
DeepMind研究员Lun Wang:制约模型能力飞跃的瓶颈是评估。现有评估难测新模型,应找序参量,构建能检测自身过时、自我进化的评估系统,否则易被意外冲击。
阅读原文 · 机器之心
DeepMind华人研究员Lun Wang离职,「评估」成制约模型能力飞跃的瓶颈
谷歌DeepMind研究员Lun Wang离职后发文指出,当下评估体系难以应对新模型,制约模型能力飞跃。现有评估多针对当前模型,新能力出现时往往无法预测,需构建能自我进化的评估系统。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
新闻资讯7
谷歌拆分DeepMind,布林力促Gemini
DeepMind换帅一周后震荡持续,谷歌将拆分它,把部分非技术团队转入谷歌汇报体系。谷歌联合创始人谢尔盖·布林重新介入Gemini。此外,Gemini因算力、内讧、官僚等问题落后。
量子位
新闻资讯7
DeepMind大佬:单体大模型穷途末路
DeepMind研究员Andrew Trask认为,因Scaling Law对资源需求攀升,AI将成协议而非程序。组合不同厂商模型有优势,当主流榜单同等评分时变革加速,之后人们将买“智能本身”。
AI寒武纪
推荐文章8
Silvia Sapora:揭秘机器学习求职面试真相
牛津大学博士生Silvia Sapora把机器学习求职面试经历原原本本写在博客中。她分享面试准备技巧、心态与谈判策略,提醒一次面试表现不定义研究者价值,该文对求职者或许比题库更有用。
机器之心
新闻资讯7
DeepMind哲学家为AGI安全奔走
谷歌DeepMind的政治哲学家Iason Gabriel入职9年,发明的对齐框架影响Gemini训练决策。在AGI承诺与AI现实伤害间,他追问AI伦理。但技术部署快,6700亿美元涌入赛道,伦理红线被踩。
新智元