自动化数学证明」共找到 1072 篇相关文章

产品应用8

以孔子命名,超越Claude 4.5 Opus,Meta发布工业级自我进化AI软件工程师CCA

Meta与哈佛联合推出工业级软件工程师CCA,它是一套让AI在工业级代码库协作的方法论,解决长上下文推理等难题。其三维解耦设计、精细记忆机制、自我进化能力获数据验证,还适合引入强化学习。

AIGC开放社区
产品应用8

GPT-5.2技术炸场!6大核心突破,办公效率拉满

OpenAI凌晨发布GPT-5.2,把专业级AI门槛拉到新高度。它有6大核心技术突破,精准戳中职场痛点。在GDPval基准测试中表现出色,有三级模型矩阵,不同版本满足不同需求,各方面能力均有显著提升。

CourseAI
新闻资讯8

谷歌卷Gemini模型,OpenAI刷GPT-5科研论文

谷歌推出Gemini 3 pro等模型,来势汹汹。OpenAI CEO称其带来经济阻力,还挖掘GPT - 5应用价值并发表89页论文,展示在科研流程中的表现,也提及失败风险与可用Prompt模板。

PaperAgent
新闻资讯3

入侵30家大型机构、Claude自动完成90%?Anthropic 被质疑,Yann LeCun:他们利用可疑的研究来恐吓所有人

Anthropic称发现黑客用Claude AI自动化完成90%网络攻击工作,称对网络安全有重大启示。但外部研究人员谨慎质疑,Yann LeCun等认为是可疑研究和营销噱头,专业安全人员也不认可其历史性转折说法。

InfoQ
新闻资讯7

扩散不死,BERT永生!Karpathy凌晨反思:自回归时代该终结了?

苹果前员工Nathan Barry得出BERT本质是文本扩散一步的结论,将表示学习算法改造成生成算法。OpenAI创始员工Karpathy对此沉思,认为生成逻辑在LLM架构中可变。实验证明RoBERTa可转为生成引擎。

新智元
产品应用7

用 AI 开发网站?这个 MCP 必装,Next.js 原生 MCP 已上线!

Next.js官方发布了自己的MCP,具备自动化调试等诸多功能,能增强代理在该框架下的开发能力。它可集成Playwright MCP,查询文档和最佳实践等,还说明了使用流程、提问方式及原理。

AI进修生
产品应用7

Qwen“半成品”推理模型刷下AIME满分,俘获大批国外开发者!实测碾压GPT-5 Thinking、还能写侦探小说

阿里发布 Qwen3-Max-Thinking 早期预览版,虽是‘半成品’,在数学推理竞赛中达 100% 正确率。Qwen3-Max-Preview 多项测试领先,速度超 ChatGPT,还成 AnyCoder 默认选项,但未开源。实测表现有优有劣。

AI前线
推荐文章8

Sam亲自泼冷水,GPT-5意外失手:我们对AI的期待,是否已被整个行业误判?

科技行业集体转向 AI,高管强调其变革性,可 OpenAI 的 Sam Altman 却泼冷水,提醒投资者高估回报。文中围绕‘AI 是否放缓’展开讨论,还分析了 GPT - 5 发布遇冷原因、AI 对就业影响等,指出 AI 发展多且快,未来潜力巨大。

InfoQ
算法论文8

NeurIPS 2025 Spotlight | 让检索、推理真正「合体」的小而强模型,AceSearcher来了

近期,多所高校研究团队发布 AceSearcher 模型,它是让同一语言模型在推理时兼任双角色的合作式自博弈框架,以两阶段训练为骨架,将推理与检索结合,提升复杂检索任务效果,在多任务上表现出色。

机器之心
开源动态8

百度0.9B参数模型登顶全球第一,聊聊PaddleOCR-VL背后的技术细节

百度PaddleOCR-VL模型仅0.9B参数,在OmniDocBench V1.5榜单获92.6分全球第一,在多能力维度达业界最佳,能处理109种语言。其采用两阶段架构,结合优质训练数据,实现高性能与低内存、快速度的平衡。

AIGC开放社区