新闻资讯7
Gemini 2.5 Pro领跑大模型IMO 2025竞赛
量子位
AI 摘要
大模型挑战IMO 2025成绩揭晓,Gemini 2.5 Pro大幅领先。测试统一环境、双人匿名评估,涉及多类数学题,几何题模型表现差,人类版结果本周六或发布,最强Gemini也可能无奖牌。
阅读原文 · 量子位
大模型IMO25数学竞赛成绩公布了
大模型挑战IMO 2025成绩出炉,Gemini 2.5 Pro以超30%总成绩断崖式领先,超出第二名89%。测试由MathArena组织,采用统一环境和双人匿名评估。还介绍了测试模型、题目及模型表现,人类版结果预计本周六发布。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
新闻资讯7
Anthropic发布Fable 5.1,性能性价比双提升
昨晚,Anthropic发布Fable 5.1和Mythos 5.1,这代沿用Fable 5参数,性能提升聚焦长任务,还降低缓存读取价。它在游戏、视频等多个领域表现出色,与同类模型对比进步明显,虽价格贵,但能力、速度有提升。
鲸选AI
产品应用8
Anthropic发布Claude 5.1,性能价格双优
Anthropic发布Claude Fable 5.1和Claude Mythos 5.1两款大模型,性能登顶且解决开发者关注问题。缓存读取费用降75%,跑分屠榜,科研能力强,安全系统重构,合作实测效果好,盲测风格与GPT - 5.6 Sol不同。
AI寒武纪
推荐文章7
API Hub低价卖Token的生意经
文章探讨大模型API Hub低价卖Token现象,指出低价出售的常是闲置算力等。分析厂商不官网降价原因,介绍第三方低价来源及Hub盈利途径,给出判断低价Hub能否用的检查清单。
AI Reading Hub
新闻资讯7
孙鹏加盟星尘智能,强化机器人后训练
9月2日消息,前字节跳动Seed团队强化学习专家孙鹏博士加入星尘智能,负责机器人强化学习方向。星尘智能有技术、资本和商业优势,孙鹏经验丰富,此次加入将助力其强化学习后训练发展。
AI前线