内部验证器」共找到 1347 篇相关文章

新闻资讯8

GPT-5.2改写粒子物理教科书!人类手算32项算不出,AI一行公式搞定

OpenAI与多校研究者发布预印本论文,GPT - 5.2 Pro猜出关键公式,后被OpenAI内部模型证明。它推翻粒子物理教科书结论,指出单负树图振幅在特定条件下不为零,这是其在基础科学第三个公开贡献案例。

量子位
新闻资讯8

我们真的变成巫师了:OpenAI API 负责人谈 AI 如何重塑软件工程

OpenAI API 负责人 Sherwin Wu 在 Lenny's Podcast 上分享,OpenAI 内部 95% 工程师用 Codex,100% PR 由其审查。他谈了 AI 重塑软件工程的现状、未来趋势,提及管理变化、创业效应、部署问题等,也为创业者给出建议。

宝玉AI
算法论文8

测试时Scaling或是最大错觉,Google:R1/O1强推理另有原因

Google 112 页论文实证,OpenAI 的 o 系列等模型推理能力提升并非仅因计算时间延长,而是源于对复杂互动的隐式模拟。通过三重验证表明推理能力跃迁或因‘吵得更凶’,而非‘算得更久’。

PaperAgent
开源动态8

DeepSeek又拿第一!首创「因果流」视觉推理,超越Gemini

DeepSeek开源DeepSeek - OCR2,引入DeepEncoder V2视觉编码,打破传统模型扫描限制,模仿人类视觉「因果流」逻辑。它解决了传统VLM忽略图像语义结构问题,在多项测试中表现出色,还验证了「LLM作为视觉编码」可行性。

新智元
算法论文8

斯坦福×英伟达发布AI推理新范式,刷新了多领域SOTA

斯坦福与英伟达联合发布论文 TTT - Discover,提出新范式,不追求通用,在推理阶段针对特定难题修改模型参数。它战绩辉煌,但成本高、是偏科生且需打分,其出现是技术与哲学的突破。

新智元
算法论文7

腾讯LLM团队:对下一个 Token 预测的深入剖析,多样性 or 精准度?

最新研究证实RL能增强LLM推理,但成效受限预训练token分布。腾讯LLM部把交叉熵重写成单步策略梯度,用超参压熵,为RL打造‘低熵高信号’起点,经实验验证低熵模型优势明显。

PaperAgent
开源动态8

低调霸榜全球最难SQL榜单超两月,国产AI这次选择高调开源!

蚂蚁数科低调霸榜全球最权威SQL榜单超两月后高调开源Agentar - SQL系列。其核心思想是让AI赋能生产,在金融场景验证后能力外溢到多领域,还采用按效果付费模式,展现强大竞争力。

量子位
新闻资讯7

Meta版「甄嬛传」!28岁天才上位,掌管6千亿命脉,AI教父愤然出走

纽约时报爆料Meta内部正上演“权力的游戏”。扎克伯格得意门生与老将冲突不断,图灵奖得主Yann LeCun或被逼离职。年初Meta还是AI开源王者,现在却面临投入与回报拷问,其最新模型“牛油果”或不再开源。

新智元
开源动态8

RLinf上新πRL:在线强化学习微调π0和π0.5

近年来,基于流匹配的VLA模型成机人领域前沿技术,但训练依赖大量人类演示数据。清华等机构联合推出在线强化学习微调框架πRL,提出两种微调方案,在测试平台验证了有效性,目前代码等已开源。

机器之心
新闻资讯7

硅谷甄嬛传爆更,马斯克转发!Ilya动手那一夜,谁捅了奥特曼一刀?

硅谷版《甄嬛传》精彩上演,理想主义者Ilya对决野心家奥特曼,马斯克火上浇油。Ilya备忘录指控奥特曼撒谎等,揭示OpenAI内部斗争。Ilya与Mira密谋除奥特曼,还错判员工反应,董事曾要求Ilya起草备忘录。

新智元