「形式化数学猜想库」共找到 374 篇相关文章
刚刚,GPT-5 Pro自证全新数学定理!OpenAI总裁直呼颠覆,大佬们集体转发
微软前AI副总裁Sebastien Bubeck让GPT - 5 Pro求解论文中未解数学区间,模型将已知下限从1/L推进到1.5/L,虽论文作者后续超了AI,但此发现仍令人鼓舞,大佬认为AI或改变数学领域。
复读一年,AI 把高考数学成绩从及格线提到 145 分!AI 数学能力发生了什么?
今年媒体让AI做高考数学题,Gemini 2.5 Pro获145分排第一。从去年到今年,AI数学能力指数级增长,这得益于推理模型。推理模型用思维链和强化学习解题,未来高考数学或难区分模型能力。
横扫八大数学竞赛:清华微软联合提出STAR-PólyaMath,Apex基准超GPT-5.5 13.5%
清华大学与微软亚洲研究院团队提出推理多智能体系统 STAR - PólyaMath,构建探索 - 推理 - 验证框架,解决大模型长程数学推理瓶颈,在八大数学竞赛基准获最优成绩,还可泛化到其他推理场景。
菲尔兹奖得主预警:AI可能杀死数学!
今年菲尔兹奖得主多伦多大学教授Jacob Tsimerman宣布加入OpenAI从事AI安全研究,因其认为2年内AI将在数学证明领域超越人类。陶哲轩、Timothy Gowers等也对此表示担忧。《莱顿宣言》发布,众多数学家签名抵制AI对数学的冲击。
Google | 发布革命性编码智能体:AlphaEvolve,突破数学极限!
DeepMind 发布由 LLMs 驱动的进化编码智能体 AlphaEvolve,能演化代码库用于算法发现和优化。它结合 LLM 创造力与自动化评估,减少幻觉,在谷歌计算生态、数学算法等多领域有巨大应用潜力。
人格向量:大模型性格的数学解码与精准操控
大语言模型在应用中会出现危险行为偏移与训练引发的非预期偏移,传统方法难监控干预。本文发现人格特质在线性方向表现为“角色向量”,实现提前预测、实时监控和主动控制,为AI安全提供数学框架。
重磅!Google 推出AlphaEvolve 实现算法自我进化,将颠覆数学与计算机科学!
Google DeepMind发布革命性的Gemini驱动编码代理AlphaEvolve,能设计并优化算法。它发现更快矩阵乘法算法、解决开放性数学问题,还优化了Google多方面计算基础架构,未来跨领域应用前景广。
OpenAI连破10道数学难题,Fable 24小时「复现」5道
这个周末,OpenAI与Anthropic两大AI巨头在数学前沿短兵相接。先是OpenAI用未发布模型Astra证明10项数学成果,不到24小时,Anthropic的Fable复现了其中5项。AI解难题成本降低,成果验证成新考验。
破解300年数学难题,智能体大突破!谷歌发布超强AI Agent
今天凌晨谷歌Deepmind发布编程AI Agent——AlphaEvolve,它与Gemini深度集成,能评估算法。它解决了300多年的数学难题,还提出新算法,提升大模型计算效率,可优化GPU指令,架构含多模块。
从大数据到好猜想:如何用大模型做市场研究?
文章指出大模型重塑用户需求调研,并非按常规用AI获取和清洗数据,而是让模型扮演真实用户。以品牌分析社交媒体数据为例,探讨大数据局限,还介绍‘好猜想’标准,最后说明Atypica.AI能构建消费者智能体解决归纳问题。