自动化数学证明」共找到 1071 篇相关文章

算法论文7

又一推理新范式:将LLM自身视作「改进操作符」,突破长思维链极限

Meta等机构研究者将LLM视为「思维」改进操作符,探究并行 - 蒸馏 - 精炼(PDR)推理方法。实验显示,PDR在数学任务中提升准确率,还训练8B模型让推理方法更适配,减少训练与部署的不匹配。

机器之心
算法论文8

从单领域到多能力协同:数据混合如何重塑AI的强化学习

上海AI Lab的OpenDataLab团队通过大规模实验剖析可验证强化学习(RLVR)在多领域推理中的机制,发现逻辑与数学数据相互支持、代码推理有跨领域混合效应等,为构建AI推理模型提供关键发现。

深度学习自然语言处理
新闻资讯8

全球第一AI科学家天团,首战封神!2.5个月找到治盲新药,医学圈震撼

世界首个AI科学家天团发布首个成果,2.5个月发现治疗失明新药。AI包办写论文全过程,人类只需执行实验。团队推出全自动化多智能体系统Robin,将开源代码,它可跨领域应用,标志科研新范式诞生。

新智元
开源动态8

OpenAI去年挖的坑填上了!奖励模型首现Scaling Law,1.8B给70B巨兽上了一课

全新奖励模型「POLAR」采用对比学习范式,摆脱对海量人工标注依赖,有强大Scaling潜力。它衡量训练与目标策略「距离」作奖励信号,用自动化合成数据预训练,小模型能超越大数十倍规模对手。

新智元
新闻资讯8

百年黎曼猜想被Claude破了新纪录!是个未公开新模型

A社官宣未公开的Claude研究模型在黎曼猜想取得重大进展,将满足猜想的黎曼ζ函数零点比例下界从41.6%提高到67.2%。它靠60个智能体、3100万输出Token完成研究,几乎走完科研流程。

量子位
算法论文8

无需奖励函数!我们意外构建了自我进化的AI系统

牛津大学发现LLM可通过“部署 - 验证 - 再训练”循环自我进化,绕开人工奖励函数设计瓶颈。在三个经典规划领域实验效果惊人,还在理论上证明其与强化学习的数学等价关系,有优势也有隐患。

AI工程化
产品应用8

PosterGen:告别学术海报制作烦恼,从PDF一键生成「演示级」可编辑PPTX学术海报

许多研究者制作学术海报耗时费力,现有自动化方法有缺陷。联合团队推出PosterGen,能将论文PDF转成可编辑PPTX海报。它有核心创新,遵循四大设计原则,工作流由四个智能体构成,实验证明其有效。

机器之心
新闻资讯7

孙凝晖院士:集成芯片带来三大科学问题

随着摩尔定律发展放缓,集成芯片与芯粒技术对高性能芯片设计制造愈发重要。孙凝晖院士在2025年度晶上系统生态大会指出,集成芯片是提升性能新路径,但芯粒集成度提升带来三大科学问题。

芯师爷
算法论文8

因果发现大模型迎来「理论破局」: DAG-FM 破解异质机制下的因果图识别与涌现难题 | GAIR Paper 116

浙大、清华与稳准智能联合发布因果发现大模型DAG - FM,解决了现有模型缺乏理论基础、易产生非法环路和显存爆炸问题。它在理论上证明因果图可识别,架构上避免环路,处理数据能力强,还将推进特定领域预训练。

AI科技评论
产品应用7

Harness Engineering实践,做了一个平台让AI一晚上自动评测和优化你的系统

作者分享搭建小平台实现全自动化评测与系统优化的实践,包括创建评测任务、集、报告等,通过钉钉文档、绘报等案例展示操作,还能自动优化系统,不过需系统UI规范、AI Coding含量高。

阿里云开发者