正式证明搜索」共找到 1052 篇相关文章

开源动态7

从“小卡拉米” 杀入 CNCF,创始人却说:HAMi火了,我们每天仍如履薄冰

本文讲述 HAMi 项目从“小卡拉米”到进入 CNCF 孵化阶段的历程。该项目解决 GPU 利用率问题,建立跨厂商生态。密瓜智能围绕其成立,补社区短板。虽 HAMi 成功,但密瓜智能仍需证明商业价值。

InfoQ
算法论文8

Anthropic让9个Claude Agent花5天做出比人类强4倍的对齐成果

Anthropic发表Automated Weak - to - Strong Researcher,用9个并行的Claude Opus Agent组成自动化研究团队,5天就把PGR从人类的0.23提升到0.97,成本约$18,000,证明AI自动化研究可行。

PaperAgent
新闻资讯8

陶哲轩看傻:三破18年数学纪录!谷歌推出「AI爱迪生」,科研不再靠灵感?

5月中旬谷歌发布AlphaEvolve,30天攻克18年未解难题。它利用Gemini模型发现新算法,从AlphaGo获启发,能在编程空间搜索方案,或开启不靠‘灵感’的科学革命,还将改变科学家角色。

新智元
新闻资讯8

谷歌年度大招:所有AI模型全升级一遍!Gemini2.5大杯中杯霸榜前二,新版视频/图像模型亮相

谷歌在I/O大会放大招,升级所有AI模型,重做原有产品,推出诸多实验性新产品。如Gemini 2.5系列升级,具备新功能;还有异步代码助手Jules、新搜索模式等,多模态模型也全线升级。

量子位
新闻资讯7

AI逼疯七巨头,马斯克们深陷中年危机!

人工智能来势汹汹,科技巨头们陷入「AI焦虑」。谷歌搜索危机、苹果AI滞后、马斯克的特斯拉销量滑坡,巨头们面临挑战,谁会成AI时代「诺基亚」尚不明朗,新兴模型也带来新变数。

新智元
算法论文7

做过十遍还要从头摸索?Agent 的记忆终于开始长成技能

MemTensor 等机构提出无需训练基础模型的 MSCE 框架,为 Agent 外部经验建‘晋升制度’,让经验成技能。该论文在 EvoAgentBench 与 LoCoMo 测试中结果更好,但在因果证明、模型依赖等方面有不足。

深度学习自然语言处理
新闻资讯8

OpenAI连破10道数学难题,Fable 24小时「复现」5道

这个周末,OpenAI与Anthropic两大AI巨头在数学前沿短兵相接。先是OpenAI用未发布模型Astra证明10项数学成果,不到24小时,Anthropic的Fable复现了其中5项。AI解难题成本降低,成果验证成新考验。

新智元
产品应用8

让两个大模型「在线吵架」,他们跑通了全网95%科研代码|深势发布Deploy-Master

科学计算领域开源软件多,但多数无法直接运行,制约可用性。Deploy - Master 针对此开发,通过搜索筛选工具、双模型博弈构建,将部署成功率提至 95%以上,为 Agentic Science 提供行动基座。

机器之心
产品应用7

谷歌Nano Banana 2 来了,图片AGI提前到来?

伴随Gemini 3、GPT 5.1小道消息,谷歌Nano Banana 2提前到来。它采用多步骤生成流程,有自我纠错循环,能替代部分Photoshop功能,在细节、配色等方面比一代提升明显,即将正式上线。

探索AGI
新闻资讯8

Google推出 AI 科学家:自动编写专家级代码,40个新方法碾压人类 SOTA

Google新发布的AI系统能编写科学软件、发明新方法,结合大语言模型与树搜索技术。在生物信息学、流行病学等多领域超人类最优水平,引发网友对科研影响的讨论。

AGI Hunt