「数学能力」共找到 3414 篇相关文章
突发!Claude挑战黎曼猜想「失败」,却意外刷新37年数学纪录
AI向黎曼猜想发起挑战,Anthropic的Claude研究版本虽未攻克该猜想,但将黎曼ζ函数中已知至少位于临界线上的零点比例下界,由41.6%提高到了67.2%,这可能是解析数论领域重大进展。
腾讯混元Hy3发布:Agent能力和产品体验跃升
7月6日腾讯混元Hy3发布,智能水平强于同尺寸模型,比肩大尺寸旗舰模型,定价降低。它已接入多个业务,API上线腾讯云TokenHub。在多领域表现出色,性价比高,采用开源协议,将在多平台上线。
数学的上帝粒子!一个运算符能导出所有基本函数
波兰雅盖隆大学的Andrzej Odrzywołek在论文中指出,仅用一个叫EML的二元运算符加常数1,就能推导科学计算器上所有基本函数,还可能为机器学习符号回归提供新思路。
陶哲轩说:AI 辅助数学证明,已经成了日常操作
世界顶级数学家陶哲轩解决 Erdős 经典问题时,全流程用 AI 做助手,从证明草案到简化证明,再到形式化验证。整个流程为人类提出猜想、AI 暴力证明、人类简化优化、AI 辅助形式化验证。
陶哲轩用GPT-5解决数学难题:仅29行Python代码
陶哲轩最新发帖称,GPT - 5帮他解决MathOverflow上的问题,证明序列lcm(1,2,…,n)并非高度丰数的子集。他与GPT - 5沟通生成参数,并用其生成的29行Python脚本验证,且未遇AI幻觉问题。这不是他首次用AI解题。
IMO 主席正式宣布:Google DeepMind在国际数学奥赛拿下金牌!
Google DeepMind的Gemini Deep Think模型在2025年IMO竞赛获金牌水平成绩。虽比OpenAI公布晚,但实现用自然语言解题质的飞跃。它采用增强推理模式,成绩经官方认证,后续将向用户开放。
深度研究白菜化?谷歌将Gemini级AI研究能力开源
谷歌推出'gemini-fullstack-langgraph-quickstart'开源项目,用Gemini 2.5与LangGraph结合,可构建本地运行的深度研究智能代理系统。介绍其技术架构、工作流程、开发配置、部署扩展,还展示了现代AI应用开发趋势。
Claude 5.1来了,但最强能力只向少数机构开放
9月1日,Anthropic发布Claude Fable 5.1和Claude Mythos 5.1,二者用相同底层模型,区别在安全限制和开放范围。Fable面向订阅用户和企业,Mythos仅向少数审核机构开放,此次还尝试新的开放方式。
Claude Opus 5 发布:Fable 5 一半的价格,更强的编码能力
Anthropic 发布 Claude Opus 5,定价与 Opus 4.8 相同,价格是 Fable 5 的一半。它在编码、知识工作和推理上表现出色,虽有不足,如速度慢、幻觉率较高,但提供多种 effort 等级,成本低,安全对齐性好。
一个文件,让 AI 拥有完整操控 Office 的能力,真绝了!
当下AI智能体处理办公文档有问题,需依赖复杂库或安装庞大软件。Github上的轻量级工具`OfficeCLI`,让AI智能体通过命令行控制办公文档,实现自动化办公,功能强大且使用方便。