定理证明器」共找到 580 篇相关文章

新闻资讯8

世界最老程序员——这个91岁的老码农用AI 搞了个教会志愿者管理系统

91岁从未碰过代码的John Blackman,在孙子介绍下,用Claude和Replit的AI agents,仅两天就搭建出教会志愿者管理系统,还分享开发到生产的挑战及使用反馈。

AGI Hunt
算法论文7

NICE59期 | Agent进入下一篇章!Alita:不靠人工预设,自己造MCP自我进化的AI

这篇论文提出让 Agent 主动创造解决 MCP 的工具实现自我进化,工具可网上检索或自主编写。Alita 做法更通用实效,还提出‘Agent 蒸馏’思想,其生成的 MCP 已用于‘manus’。

深度学习自然语言处理
新闻资讯8

最强编码模型Claude 4来了!Mcp集成无需Client,扩展提示缓存增强Agent长上下文保持能力

Anthropic 昨日推出新一代 Claude 模型,包括 Claude Opus 4 和 Claude Sonnet 4,在编码、高级推理和 AI Agent 方面树立新标准,有卓越编码能力、显著提升的 Agent 能力、全新 API 功能,Claude Code 也全面上市。

AI工程化
开源动态8

OpenAI深夜开源HealthBench,60个国家合力开发5000段真实对话

今天凌晨1点30,OpenAI开源医疗大模型测试评估集HealthBench。其5000段核心测试对话由60个国家/地区的262名医生打造,采用多轮对话测试。测试显示大模型在医疗保健领域表现显著提升,还介绍了其构建及评估等情况。

AIGC开放社区
推荐文章8

Lilian Weng:Harness才是模型自我迭代的现实起点和关键,而不是直接重写权重

Thinking Machines Lab联合创始人Lilian Weng发文指出,实现AI递归式自我改进(RSI),设计围绕模型的执行系统“Harness”才是现实起点。文中详述Harness设计模式、优化路径,也指出自我改进面临的瓶颈。

AI寒武纪
新闻资讯7

Fable 5回归全网抓紧测!发现GLM-5.2更香了,价格只有1/39

Claude Fable 5消失19天后全球再上线,7月1 - 7日Pro等订阅用户可用,但额度受限。它实力强但贵,与多模型对比表现优,远程工作能力突出。不过使用限制变多,安全分类易误伤。

量子位
算法论文8

CVPR 2026|突破3D空间推理瓶颈:北大联合南科大提出QuatRoPE,让大模型精准理解三维物体关系

北大联合南科大团队提出全新 3D 位置嵌入方法 QuatRoPE,改善大语言模型 3D 空间推理痛点。还提出 IGRE 降低干扰,构建 ASR 基准评估能力。研究被 CVPR 2026 接收,代码与模型已开源。

机器之心
算法论文8

VLA大模型做长任务总断片?同济KC-VLA用关键帧链给治好了

VLA大模型记性是短板,处理非马尔可夫任务常束手无策。同济大学等提出KC - VLA框架,用关键帧链接赋予机人全局时间感知能力,还构建了长时序记忆依赖基准测试,实验显示其性能优越。

PaperAgent
算法论文8

北航,清华,北大联合发布: 异构智能体协同强化学习!

北航、清华、北大联合发布异构智能体协同强化学习论文。提出 HACRL 新范式,实现异构智能体双向互学与独立部署统一;还有 HACPO 算法弥合智能体差异。实验显示性能提升且成本降低,为多智能体协同学习指明方向。

机器之心
开源动态8

腾讯纯文本LLM训视觉encoder,拿捏图表长视频,达到开源小模型SOTA!

腾讯开源Penguin - VL,直接用纯文本LLM训视觉编码,跳出传统多模态拼接套路。在2B/8B紧凑参数规模的复杂任务中竞争力强,训练分三阶段,相关代码、模型等已开放。

量子位