自动化定理证明」共找到 812 篇相关文章

开源动态8

AI驱动的开源攻击框架:HexStrike-AI

HexStrike-AI是安全研究员开发的开源攻击框架,2025年7月起在GitHub免费提供。它基于MCP协议,集成LLM与150多种工具,可自动化渗透测试和漏洞发现。曾被网络犯罪分子利用,能加速攻击流程,展现强适应和并行化能力。

AI与安全
算法论文8

斯坦福华人研究火了:45分钟让你的论文变身AI智能体!

斯坦福大学研究人员提出Paper2Agent,可将静态论文转化为可交互的AI智能体。它提供自动化工作流,核心是封装成MCP服务器。通过三个案例展示其将不同论文转化为智能体的能力,提升科研成果易用性与可复现性。

新智元
新闻资讯7

GPT-5通过“哥德尔测试”!独创性解决博士生都得花几天时间的开放数学问题

最新论文中,研究人员让GPT - 5挑战5个未解决的优化猜想,它解出3个,还对一题给出不同有效证明方案。测试题需博士水平研究者花几天完成,研究还“挑衅”了陶哲轩对大模型数学能力的印象。

量子位
开源动态8

NeurIPS 2025 | 面向具身场景的生成式渲染器TC-Light来了,代码已开源

TC-Light 是中科院自动化所张兆翔教授团队研发的生成式渲染器,能对长视频序列重渲染,减少 Sim2Real Gap 及实现数据增强。它克服了时序一致性和计算开销挑战,性能优于现有技术,论文与代码已开源。

机器之心
算法论文7

Mini-Omni-Reasoner:实时推理,定义下一代端到端对话模型

现有端到端对话模型推理能力未解锁,因深度思考带来延迟。为此提出 Mini - Omni - Reasoner,采用边思考边表达范式,突破‘要么快,要么准’困境,还设计了数据合成管线和五阶段训练方法,实验证明其性能提升明显。

机器之心
新闻资讯7

DeepSeek刚提到FP8,英伟达就把FP4精度推向预训练,更快、更便宜

DeepSeek提及针对国产芯片的FP8量化设计,引发对大模型量化策略关注。不久后英伟达发力低精度量化,将NVFP4策略拓展到预训练阶段,其方案能解决核心挑战,实验证明NVFP4在大规模训练中可行。

机器之心
开源动态8

o3 Gemini 都翻车?首个可验证长链 GUI 数据集 VeriGUI 重磅开源,探索通用 Agent 能力边界

GUI 智能体发展遇瓶颈,现有数据集难评估其长时程规划能力。2077AI 开源基金会牵头构建的 VeriGUI 应运而生,有长链复杂性与子任务级可验证性特征,论文登 Hugging Face 月榜第三,还证明现有模型瓶颈。

AI科技评论
新闻资讯8

7个月翻一番!AI agent能力飙升,METR报告揭示指数级进化规律

非营利研究机构METR报告显示,Agent能力每7个月翻一番,这在9项基准测试中得到验证,任务涉及编程、数学等领域,大模型正迈向高度自动化,且Agent性能提升快,未来处理复杂任务能力或更强。

量子位
算法论文7

一个运行了80年的算法,我们现在才真正理解它?

近80岁的单纯形法是优化领域基石,广泛用于包裹配送、飞机航线规划等,但此前没人能从理论上完美解释其高效原因。现在,Huiberts和Bach找到了谜题的最后一块拼图,不仅让算法更快,还从理论上解释了现象。

机器之心
产品应用8

全球首个英伟达含量为0的万亿模型,成了海外开发者的抢手货

美团推出LongCat-2.0,是首个在国产算力上实现全链路训推闭环的万亿参数模型。它多项性能强,适配主流编程工具,架构设计原创,还证明了国产算力有支撑大模型迭代的能力,训推成本更低。

量子位