形式化定理证明」共找到 365 篇相关文章

算法论文8

聊聊Anthropic这篇最新研究,我觉得可能是AI意识诞生的前夜。

Anthropic最新研究《A Global Workspace in Language Models》,在Claude神经网络中发现与人类大脑意识通达结构功能高度相似的J空间,这结构自发涌现,研究还证明其对Claude输出有影响,或改变人类对意识的理解。

数字生命卡兹克
算法论文8

HyperEyes:从「搜得更深」到「搜得更宽」,并行多模态搜索智能体的效率革命

小红书研究团队提出 HyperEyes 模型,打破现有多模态搜索智能体串行处理模式困局。通过全栈设计实现并行多模态搜索范式跃迁,在多基准测试中表现优异,证明准确率与效率可协同进化。

机器之心
新闻资讯8

谷歌Gemini 3杀疯了!陶哲轩亲测:10分钟干翻百年数学难题

Gemini 3本周一发布后开启横扫基准测试之旅。在FrontierMath基准测试创纪录,Epoch能力指数超GPT - 5.1。陶哲轩用Gemini Deepthink十分钟解决埃尔德什问题关键证明,同时它还霸榜物理基准测试CritPt。

新智元
推荐文章7

AI一边平权,一边拉开差距

互联网大佬爱讲“AI平权”,却没说AI变强、获知识门槛降低时,人和人差距反而拉大。决定差距的关键是提问力等三个能力,真正的提问力是对问题“形式化定义”的能力。

newtype AI
新闻资讯8

科学家要失业了?GPT-5仅用18分钟解出黑洞方程,效率碾压人类数月!

2026年AI成科学家新战友,从破解优化难题到重现黑洞对称性,加速科学发现。数学家与ChatGPT合作完成证明,物理学者用GPT-5 Pro快速解黑洞方程,OpenAI还助力攻克生物学难题。

新智元
新闻资讯7

OpenAI IMO金牌团队爆料:AI拒绝作答第六题

OpenAI IMO团队接受采访,透露让模型获IMO金牌的项目仅用两三个月、核心开发者仅三人。还谈及模型证明风格、第六题失分原因、解决千禧年大奖难题距离等,强调通用技术及面临的新挑战。

机器之心
开源动态8

告别Transformer!北大、北邮、华为开源纯卷积DiC:3x3卷积实现SOTA性能,比DiT快5倍!

北大、北邮和华为研究提出纯卷积扩散模型 DiC,抛弃自注意力机制回归 3x3 卷积。它性能超 DiT,推理速度快 5 倍,证明精心设计的卷积网络在生成任务中也能表现卓越。

机器之心
算法论文8

关键突破:理论验证了 RL for LLM 路线的可行性

传统RLHF依赖人工标注偏好数据训练奖励模型,成本高且难扩展。本文发现任何通过Next - token预测训练的LLM内部隐含通用奖励模型,从理论和实验证明其可高效实现模型对齐。

深度学习自然语言处理
算法论文7

1万tokens是检验长文本的新基准,超过后18款大模型集体失智

Chroma团队研究发现,将上下文扩展至1万tokens,18款主流大模型集体“失智”,“智商”非均匀下降,在一些节点会断崖式下跌。研究还设计四项对照实验,证明LLMs性能随输入长度增加显著且非均匀下降。

量子位
新闻资讯7

Karpathy实测Opus 5:读一段《魔戒》,10美元直出中土世界!

Andrej Karpathy 用 Opus 5 结合《指环王》开篇文字,花约 10 美元让其渲染 3D 游戏。Opus 5 两小时写出 5500 行代码生成 3D 世界,虽粗糙但证明 AI 强大。不过,LLM 无法高效审查自己工作,这是弱点。

新智元