「双层思考机制」共找到 1481 篇相关文章
18岁天才少年,登上Nature封面!
DeepSeek-R1荣登Nature封面,成史上首个经严格同行评议大模型。18岁天才少年涂津豪以实习生身份参与,其从高中生到Nature作者的经历堪称传奇。他还改造Claude 3.5,开源项目获15k多星,还对AGI发表思考。
OpenAI发布新模型硬刚Anthropic!Claude Code刚火,就被GPT-5-Codex拍在沙滩上?
9月15日,OpenAI推出新模型GPT - 5 - Codex,是微调的GPT - 5变体,用于AI辅助编程。它增强了代码审查功能,能动态调整思考时间,在多项基准测试中表现优于GPT - 5,发布后引发网络热议,AI编码工具市场竞争激烈。
奥数金牌只是序章!OpenAI谷歌彻底打脸预言家,AI巨浪势不可挡
2022年专家预言AI到2025年赢得IMO金牌概率低,结果OpenAI和谷歌DeepMind的LLM提前摘金。此前多项AI基准测试预测也失准,AI发展远超预期。GPT - 5降低使用门槛,群体智能时代到来,各机构需重新思考生存之道。
ICCV 2025 | EPD-Solver:西湖大学发布并行加速扩散采样算法
扩散模型成生成任务主流技术,但逐步去噪机制致推理延迟大。西湖大学提出 EPD - Solver 算法,融合三类加速思路优势,可减少积分误差、提升生成质量,还能作插件集成,突破扩散模型速度与质量权衡瓶颈。
全球首个IMO金牌AI诞生!谷歌Gemini碾碎奥数神话,拿下35分震惊裁判
谷歌DeepMind官宣Gemini Deep Think在IMO获官方认证金牌,4.5小时解5题得35分。它用纯英语解题,结合并行思考与强化学习训练。谷歌后续将向部分测试者及订阅者推出模型,还公开了解题过程。
大模型能力,小模型成本!Google等 | 提出递归混合框架:MoR, 大幅提升LLM计算效率
Google提出递归混合框架(MoR),融合参数共享与自适应计算。它有轻量级路由和KV缓存策略,在不同路由机制各有优劣。实验显示,MoR在性能、计算和内存效率上表现出色,有望实现“大模型能力,小模型成本”。
ICML2025 | 揭示MLLM的图文联动推理能力
当前多模态大语言模型(MLLMs)在图文深度融合推理能力上面临挑战,现有评测基准无法真正检验该能力。EMMA基准应运而生,它从四大领域精选题目,采用双重过滤机制和细粒度标注体系,评测发现MLLMs存在多模态推理危机。
Granola:ChatGPT、Notion 都入场的 AI 纪要,能真正沉淀工作流吗?
AI 发展带动大量 AI 纪要工具兴起,Granola 凭借新颖 AI 交互方式和对 AI 产品的深入思考,成为领域后起之秀。它提供 AI 补充人工笔记功能,改变了很多知识工作者工作流,但也面临用户习惯和大模型公司切入等挑战。
见证历史!DeepSeek跃居全球第二AI实验室,R1登顶开源王座,R2全网催更
昨晚,DeepSeek官宣R1完成小版本升级,开启「深度思考」功能可体验。其R1-0528性能媲美o3和Gemini 2.5 Pro,还微调了8B模型。DeepSeek成全球第二大AI实验室和开源王者,网友催更R2。
One RL to See Them All?一个强化学习统一视觉-语言任务!
国内初创公司 MiniMax 提出 V-Triune 系统,可让 VLM 单一训练流程学视觉推理和感知任务。它含三个组件与动态 IoU 奖励机制,基于此的 Orsta 模型在多项测试中性能提升显著,凸显统一 RL 方法有效性和可扩展性。