算法论文8
UCLA团队:Gemini 2.5 Pro凭提示词获IMO金牌
AI寒武纪
AI 摘要
UCLA杨林团队论文显示,Gemini 2.5 Pro通过设计的自我验证流水线和双提示词系统,解决2025年IMO竞赛5道题,未解决1道。结果手动验证但未获组委会认可。
阅读原文 · AI寒武纪
刚刚!UCLA杨林团队证明:仅凭提示词,Gemini 2.5 Pro就可以拿到IMO2025金牌
加州大学洛杉矶分校杨林和黄溢辰撰写论文,阐述利用Gemini 2.5 Pro解决2025年IMO竞赛5道题达金牌水平。设计解题者和验证者构成的自我验证流水线,用双提示词系统迭代,还规避数据污染问题。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
产品应用7
Seedance 2.5四层控制法降废片率
Seedance 2.5上线后,单条画质好但成片易散架,废片率高。文章将官方提示词指南和一线分镜写法整合成四层控制框架,还给出30秒短剧分镜示例,助你定位问题、提高抽卡效率。
AI Reading Hub
新闻资讯7
Claude砍词Opus 5却“增肥”72%
Anthropic宣布删掉Opus 5等模型超80%系统提示词,因早期提示词规则多易冲突。但网友实测Opus 5比Opus 4.8提示词加长72%,新增内容用于约束模型主动行为。
量子位
新闻资讯7
Claude Opus 5提示词泄露,能力遭全面测试
Anthropic的Claude Opus 5上线当天,系统提示词被开发者Eversmile1传到GitHub。提示词含产品说明、法务合规手册、推销渠道内容。其记忆规则严格,版权引用限制多,商业推荐有不同策略。上线24小时能力被广泛测试。
新智元
算法论文8
清华微软STAR - PólyaMath超GPT - 5.5 13.5%
清华大学与微软亚洲研究院团队提出推理多智能体系统 STAR - PólyaMath,构建探索 - 推理 - 验证框架,解决大模型长程数学推理瓶颈,在八大数学竞赛基准获最优成绩,还可泛化到其他推理场景。
机器之心