图像级推理」共找到 3165 篇相关文章

新闻资讯8

黄仁勋做客美国第一播客:每天都在担心英伟达倒闭

英伟达CEO黄仁勋做客美国第一播客Joe Rogan,畅谈AI底层逻辑与技术演进,还分享英伟达创业历程。他指出AI已从检索转向推理,数据中心成“AI工厂”,并坦言每天担心公司倒闭。

量子位
算法论文8

陈丹琦新作:大模型强化学习的第三条路,8B小模型超越GPT-4o

陈丹琦团队提出结合RLHF和RLVR优点的RLMT方法,支持在基础模型上直接使用,节省后训练成本。它让模型生成CoT,用奖励模型评价输出,使小模型超越大模型,推理更像人类。

量子位
8

Transformer终结者!谷歌DeepMind全新MoR架构问世,新一代魔王来了

KAIST、谷歌DeepMind等机构发布的MoR架构,推理速度翻倍、内存减半,重塑LLM性能边界,碾压传统Transformer。它融合参数共享与按需计算,有路由和KV缓存策略,实验显示其性能优越、可扩展性好。

新智元
开源动态8

陶哲轩转发!DeepMind开源「AI数学证明标准习题集」

DeepMind开源形式化数学猜想库,收录经典数学猜想,还提供代码函数方便形式化表述。此库可作测试基准提升AI数学推理能力,是AI+ATP范式关键前置步骤,团队邀更多人参与丰富内容。

量子位
新闻资讯7

claude 4摔碎了码农的饭碗~

昨晚Anthropic发布Claude 4系列模型,Opus 4编码能力强,SWE - bench测试成绩优,能完成7小时代码重构。Claude 4让完成日任务的时间提前,各应用纷纷接入,部分产品有应对策略。

探索AGI
算法论文8

Claude和GPT思维链竟被两步蒸馏!116页论文曝光API致命漏洞

2026年AI蒸馏成悬案,一篇116页论文砸穿巨头「黑盒」。研究人员用低价小模型恢复Claude、GPT和Gemini原始推理,还发现API漏洞存在跨会话、用户和模型互通情况,收集公开轨迹泄露诸多敏感信息。

新智元
新闻资讯7

奇点临近!全球AI终局战,只剩OpenAI和Anthropic的双人舞

全球AI终局战,只剩OpenAI和Anthropic双雄争霸。OpenAI的GPT-5.5展现指数跃迁,Anthropic的Claude系列也有稳定加速,但面临算力危机。谷歌投资Anthropic,自身Gemini掉队,其他玩家也难跻身第一梯队。

新智元
产品应用8

GPT-Image-2正式发布!设计师可以告别「古法设计」了

OpenAI正式发布ChatGPT Images 2.0(GPT - Image - 2),它是首个具“思考”能力的图像模型,处理复杂任务能力强,实测在商品广告、论文海报等场景表现出色,已全量上线,在大模型竞技中领先。

量子位
产品应用8

Codex 大更新:一个 AI,接管你所有软件。

Codex 迎大更新,有望成 OpenAI 超应用核心。它能与多工具协作,超 300 万开发者在用,近半使用场景非写代码。具备跨应用多 Agent、非编码任务处理等功能,还增添图像生成等特性。

AI进修生
开源动态8

告别直接生成,文生图进入Agent时代:港中文联合伯克利开源Gen-Searcher

过去文生图多是‘直接出图’,遇真实世界知识等易翻车。港中文等团队提出Gen - Searcher,让图像生成模型像Agent一样搜索等,数据、模型和代码均已开源,实验显示它提升了生图准确性和质量。

机器之心