「AI推理能力」共找到 11875 篇相关文章
OpenAI杀疯了!五天内再破千禧年数学难题,霍奇猜想也要被攻破了?
本文爆料头部AI实验室破解千禧年数学难题的最新进展,OpenAI攻克纳维-斯托克斯问题后,五天内就在霍奇猜想上取得实质性进展,Anthropic也接近解决另一难题,展现AI推理能力的飞速迭代。
爆火「开源投资框架」,AI时代的伯克希尔
AI投资虽火但常给出正确废话,AI Berkshire爆火,兼容Claude Code和OpenAI Codex,有18个Skill。它将四位投资大师方法论抽象成流程,通过多Agent协作完成投研闭环,还有强制给结论等特点。
2025 年中丨大模型市场分析报告
这是《2025年中丨大模型市场分析报告》。指出基础大模型塑造计算未来,企业重心转向推理。Anthropic超OpenAI成市场头号玩家,开源模型采用趋缓,企业换模型重性能,AI支出从训练转向推理。
The Batch: 953 | 大型 AI 扩张计划冲击碳减排承诺
大型AI公司大规模建设数据中心,为满足AI预期需求扩张,正干扰其碳减排承诺。Alphabet、Amazon等公司虽有清洁能源计划,但目前仍依赖化石燃料,总排放均有增长。
The Batch: 918 | 智能体 AI 引发投资者恐慌
投资者担忧AI系统动摇软件制造商商业根基,致标普软件与服务指数等大幅下挫。Anthropic推出多款产品加剧风波,后与部分公司合作使SaaS类股反弹,但未收复全部跌幅。AI正重塑软件市场,SaaS未死,正迈向AI原生化。
200K上下文突破:AI编程新星Augment崛起
AI编程新星Augment以65.4%的SWE - bench评分登顶榜首,估值超128亿美元。它能理解海量代码上下文,支持多环境集成。但新式AI编程工具存在安全风险,如Agent Memory恶意攻击等,文中给出应对建议。
马斯克转发字节Seed&哥大商学院新基准:大模型搞金融,连查个股价都能出错
字节跳动Seed团队与哥大商学院推出开源金融搜索与推理基准测试FinSearchComp,含635个问题。评测显示大模型处理金融任务有差距,凸显金融AI能力评估重要性,还揭示了关键能力差距。
《2026 OpenClaw 类自主智能体发展白皮书》正式发布 | 中科算网算泥社区
5月20日,中科算网算泥社区发布《2026 OpenClaw类自主智能体发展白皮书》,阐述从“对话式AI”到“代理式AI”的转变。介绍OpenClaw类自主智能体定义、技术剖面、关键能力及系统架构,为从业者提供参考。
浏览器里的 AI 革命:前端工程师的新战场
AI 进入浏览器和前端,JavaScript 扮演新角色。浏览器端 AI 崛起,能在本地提供智能服务。AI 可增强 JS 应用,有多种工具支持,但也面临性能、模型尺寸等挑战,未来前景广阔。
从“工具”到“同事”——AI 时代的产品进化
在QCon 2026北京站,苏杰让AI数字分身演讲,探讨AI时代产品进化。从产品、组织和个人层面判断未来趋势,介绍产品新形态、创新方法,还提及组织和个人应对策略,分享用AI准备演讲的体验。