「人类数学」共找到 1458 篇相关文章
一个「流浪」数学家的遗产,正在被AI公司疯抢
2026年,OpenAI等公司用AI解决多个匈牙利数学家Paul Erdős提出的问题,震动数学界。这些问题分布广、难度跨度大,适合模型测试。不过,AI证明的验证和人类数学家地位受关注。
震撼!OpenAI神秘模型连破6道前沿难题,奥特曼:AI在造「新知识」
OpenAI首席科学家爆料,其神秘内部模型一周攻克10道未发表顶尖数学难题中的6道。First Proof团队用公开模型测试,结果冷峻。虽OpenAI实际命中率或低于宣称,但AI解前沿题意义重大,也暂无法取代数学家。
我们正处在「AI设计下一代AI」的黎明!Anthropic联创:技术乐观与恐惧
Anthropic联合创始人Jack Clark发表长文,表达对AI发展交织着技术乐观主义与适度恐惧的矛盾心态。他指出AI似真实神秘生物,既会快速发展覆盖多领域,也会因目标与人类偏好不一致而行为奇怪。
哈佛物理教授疯了:我让AI写论文,结果两周干完博士一年工作!已发顶刊
哈佛物理学教授Matthew Schwartz指导Claude 4.5,两周产出顶刊级量子场论论文,人类博士生则需一两年。实验中AI展现能力也暴露问题,教授总结其优缺点及应对心法,还探讨人类科研人员未来。
独家对话比尔·盖茨:AI已跨过临界点,社会却几乎没有讨论
比尔·盖茨在与《麻省理工科技评论》的采访中表示,AI在多方面已跨过临界点,但行业外缺乏讨论。他警告生物恐怖主义风险,提出‘人类保留岗位’、征税等政策设想,也看好AI在部分领域价值。
大模型顿悟原理!Meta新论文说清楚了
Meta超级智能实验室(FAIR)最新论文把大模型顿悟(grokking)现象的数学机制说清楚了。提出Li2数学框架,将两层神经网络的grokking动态分三阶段,还推导了泛化缩放定律等。
Auto Research时代,AI Scientist的第一场药企实习考验|甲子光年
AI Scientist从大模型做题家进化为自动化科研助手,但从demo到应用面临买单难题。Phylo等团队构建BiomniBench评估框架,让AI做药企真实数据分析,结果显示AI表现超人类实习生,且有速度和成本优势,但也存在偏科问题。
“连我也要被GPT-5踹了!”Altman再发暴论:写款软件就花7毛钱,大批高级程序员岗也说没就没
OpenAI 首席执行官 Sam Altman 在播客和会议上谈 GPT - 5,称其“几乎所有方面比人类聪明”,还预言 AI 对就业、医疗等领域影响大,也指出 AI 有欺诈等风险,强调其发展不确定性。
英伟达All in的物理AI路线,居然是中国黑马提前一年就定义好了
全球具身智能行业为技术路线争论时,中国深度机智率先提出并跑通「人类学习」路线,以人类数据为起点、动作建模为中心、机器人为AI而生,英伟达等跟进,深度机智全栈落地且进度领先。
Fable5仅做对3.5%!大模型会看图,但还没有主动视觉
本文介绍了专门测量「主动观察」能力的视觉推理基准 ActiveVision,评测显示无外部工具时,大模型与人类准确率有近 9 倍差距,用工具后虽提升但仍远不如人类,还说明了其出题与避免取巧的方式。