形式化证明」共找到 358 篇相关文章

算法论文8

分享2篇OpenClaw最新Skill论文~

OpenClaw作为最大开源Agent框架,其Skill生态安全受关注。分享两篇论文,《Clawdrain》揭示Token耗尽攻击,《SkillFortify》提出形式化防御框架,从攻防维度揭示OpenClaw深层安全风险。

PaperAgent
算法论文7

让大模型指哪打哪的Multi-Agent路由新范式

随着MCP生态兴起,一个Assistant背后可能挂数百工具/子Agent,传统检索方式有成本高、埋没工具等问题。作者提出Tool-to-Agent Retrieval新范式,实验显示指标全面提升,证明工具细节能补足语义。

PaperAgent
新闻资讯8

陶哲轩:AI 正在让“想法”变得廉价,而真正的瓶颈从未改变

数学家陶哲轩与Dwarkesh Patel访谈,探讨AI在科学发现中的作用。他指出AI让‘想法生成’成本降为零,验证想法成新瓶颈;AI擅长广度,人类擅长深度;AI负责找证明,人类提炼‘理解’与‘智慧’。

力学与人工智能
开源动态7

从“小卡拉米” 杀入 CNCF,创始人却说:HAMi火了,我们每天仍如履薄冰

本文讲述 HAMi 项目从“小卡拉米”到进入 CNCF 孵化阶段的历程。该项目解决 GPU 利用率问题,建立跨厂商生态。密瓜智能围绕其成立,补社区短板。虽 HAMi 成功,但密瓜智能仍需证明商业价值。

InfoQ
算法论文8

LLM的快速、慢速与工具增强思维模式综述

大型语言模型在不同任务中对推理策略需求差异大,策略选择不当会影响效率与可靠性。本文提出双重知识边界框架,梳理LLMs推理模式,将策略选择形式化,还分析了决策因素及策略选择机制。

深度学习自然语言处理
算法论文8

Anthropic让9个Claude Agent花5天做出比人类强4倍的对齐成果

Anthropic发表Automated Weak - to - Strong Researcher,用9个并行的Claude Opus Agent组成自动化研究团队,5天就把PGR从人类的0.23提升到0.97,成本约$18,000,证明AI自动化研究可行。

PaperAgent
开源动态8

通义实验室大火的 WebAgent 续作:全开源模型方案超过GPT4.1 , 收获开源SOTA

WebAgent续作《WebShaper: Agentically Data Synthesizing via Information-Seeking Formalization》提出对information-seeking任务形式化建模,设计训练数据合成方法,全开源模型方案在GAIA评测获SOTA表现,还补足了训练数据不足问题。

机器之心
算法论文7

做过十遍还要从头摸索?Agent 的记忆终于开始长成技能

MemTensor 等机构提出无需训练基础模型的 MSCE 框架,为 Agent 外部经验建‘晋升制度’,让经验成技能。该论文在 EvoAgentBench 与 LoCoMo 测试中结果更好,但在因果证明、模型依赖等方面有不足。

深度学习自然语言处理
新闻资讯8

OpenAI连破10道数学难题,Fable 24小时「复现」5道

这个周末,OpenAI与Anthropic两大AI巨头在数学前沿短兵相接。先是OpenAI用未发布模型Astra证明10项数学成果,不到24小时,Anthropic的Fable复现了其中5项。AI解难题成本降低,成果验证成新考验。

新智元
新闻资讯8

北大数学家终结50年猜想!一只蝴蝶翅膀,竟难倒菲尔兹奖得主

历时50年的「十杯马提尼猜想」被北大Lingrui Ge等学者证明。该猜想连接量子物理和数学,为解「霍夫施塔特蝴蝶」之谜。他们基于「全局理论」找到对偶方程,成果发表在arXiv,还攻克另外两个关键问题。

新智元