「自动化数学证明」共找到 1071 篇相关文章
大模型也需要自我反思,上海AI Lab合成“错题本”让大模型数学成绩提升13.3%
上海AI Lab提出LEMMA方法,构建“错误 - 反思 - 修正”数据,让大模型从错误中学习。通过教师模型定向制造“学生会犯的错”构造数据,实验显示在Llama3 - 8B上数学解题准确率提升13.3%。
OpenAI两位首席最新采访信息量好大!终极目标是“自动化研究员”,招人并非寻找“最出圈”的人
OpenAI首席科学家Jakub Pachocki和首席研究官Mark Chen在采访中爆料,谈到GPT - 5将推理引入主流、实现自动化研究员目标、强化学习未到瓶颈等,还阐述用人标准、算力分配等问题。
4B小模型数学推理首超Claude 4,700步RL训练逼近235B性能 | 港大&字节Seed&复旦
香港大学NLP团队联合字节跳动Seed、复旦大学发布Polaris强化学习训练配方,让4B模型数学推理能力超商业大模型,且Polaris-4B可在消费级显卡部署,相关内容已全部开源。
AI Agent搞定世纪首次菲尔兹奖成果形式化!一周时间独立完成,20万行代码已公开
Math公司的AI Gauss用5天完成原本需6个月的菲尔兹奖级数学成果形式化证明,一周搞定24维情形,还修正原论文错误。其创始人是xAI联合创始人Christian Szegedy,代码已公开。
突发,Claude首破黎曼猜想新纪录!
Anthropic让内部研究版Claude证明「黎曼猜想」失败,但它将符合猜想的黎曼Zeta函数零点比例下限从41.6%提升到67.2%。此成果意义重大,标志AI进入开放数学研究。
陶哲轩震撼!数学家1975年埋下的「坑」,被AI和全球网友用48小时填平了
2025年12月,困扰数学界50年的Erdos#1026问题被攻克。陶哲轩宣布,在AI辅助下人类团队仅用48小时就完成证明。传统方法可能需数周甚至数月,AI带来全新理解,生成了新数学洞见。
高德纳:「震惊!震惊!」Claude破解《计算机程序设计艺术》难题
著名计算机科学家高德纳在论文中表达对AI强大能力的震惊,其朋友借助Claude Opus 4.6解决了他研究几周的开放性问题。Claude经31步探索给出Python构造程序,奇数情况获证明,偶数仍待解。AI在数学领域已取得多方面突破。
菲尔兹奖成果首次被AI完整形式化,Gauss20万行代码改写数学史?
Math, Inc. 公司用 Gauss 智能体完成 8 维和 24 维空间最优球体堆积定理形式化证明,代码约 20 万行。该定理最初由 Maryna Viazovska 及其合作者证明,这是本世纪首个被完全形式化证明的菲尔兹奖成果。
陶哲轩亲自曝光:AI破解数学难题,竟全是「抄」的?
数学大神陶哲轩发现,AI声称破解的Erdos难题,实则是多年前已被人类解决的旧闻。他指出当下AI进化逻辑并非创新,而是利用算力扫描人类文献的‘长尾黑洞’,其核心价值是填补人类知识遗忘漏洞。
阿里开源Mobile-Agent-v3:多模态GUI智能体,实现跨平台自动化突破!
全新自动化时代,GUI智能体融入日常。阿里巴巴通义实验室推出GUI - Owl与Mobile - Agent - v3,实现跨平台自动化突破。文章解析其发展历程、技术创新,且项目开源,商业化潜力引关注。