「观测的暴露度」共找到 10774 篇相关文章

开源动态8

万亿参数狂欢!一文刷爆2025年七大顶流大模型架构

文章深入剖析2025年顶级开源模型的创新技术,介绍了DeepSeek V3/R1、Kimi 2、Qwen3等七大顶流大模型架构,揭示滑动窗口注意力、MoE和NoPE如何重塑效率与性能。

新智元
开源动态8

一个模型超了DeepSeek R1、V3,参数671B,成本不到350万美元

Deep Cogito 是旧金山 AI 初创公司,开源四款混合推理模型。最大 671B MoE 模型性能超 DeepSeek v3 等,推理链比 DeepSeek R1 短 60%,训练成本不到 350 万美元。核心方法是迭代蒸馏与增强。

机器之心
新闻资讯7

开出10亿美元天价,小扎挖人Mira创业公司惨遭拒:俺们不差钱

七月,Meta 超级智能实验室挖人不停。扎克伯格瞄向 Mira Murati 创立的 Thinking Machines Lab,开出超 10 亿美元报价却无人接受。同时,Meta 还挖走苹果第四位核心成员,苹果小幅提薪仍难留人。

机器之心
产品应用8

最高能效比!他又死磕“存算一体”2年,拿出全新端边大模型AI芯片

后摩智能CEO吴强在今年WAIC期间发布业界能效比最高的存算一体端边大模型AI芯片后摩漫界®M50。它搭载第二代存算一体技术,全栈自研实现软硬件协同优化,还配套系列产品,构建端边智能新生态。

量子位
新闻资讯7

AI游戏创新大赛线下终极对决!世纪华通发起,ChinaJoy见证最终冠军诞生

7月23日,世纪华通发起的“数龙杯”全球AI游戏及应用创新大赛在上海举办线下路演。20余款AI作品团队展示创新成果,覆盖多领域。评审严格考评,最终结果8月1日在ChinaJoy揭晓。

量子位
算法论文8

ICML 2025 | 大模型能在信息不完备的情况下问出正确的问题吗?

当前大语言模型推理研究多聚焦被动推理,主动推理研究少,制约其在现实场景应用。为此提出 AR - Bench 基准评估大模型主动推理能力,实验显示大模型主动推理能力严重不足,并指出后续拓展方向。

机器之心
新闻资讯8

谷歌深夜打假!27页论文全公开,揭秘Gemini如何碾压OpenAI,拿下IMO真金牌

OpenAI高调庆祝自家模型获IMO金牌,谷歌DeepMind携官方认证和27页论文官宣Gemini碾压夺金。谷歌公开解题方法论,介绍三步思考法及相关Prompt,还对比批评了OpenAI的做法。

探索AGI
新闻资讯7

OpenAI新Agent遭中国24人初创团队碾压!实测成本、质量全输惨,海外用户:中国Agent代差领先

今日凌晨,OpenAI 推出 ChatGPT Agent 新功能,能让 AI 助手完成多步骤任务。虽官方称其性能先进,但实际效果有局限。海外用户将其与中国团队产品对比,发现中国 24 人初创团队产品成本、质量更优。

AI前线
新闻资讯7

思维链之父跳槽Meta,不只因为1亿美元!离开OpenAI前泄天机

硅谷人才争夺战升级,Meta砸钱抢人,思维链之父Jason Wei从OpenAI跳槽到Meta。他离职前发博客,谈及从强化学习获得的人生启示,还阐述AI领域验证非对称性概念及重要性。

新智元
新闻资讯7

OpenAI谷歌Anthropic罕见联手发研究!Ilya/Hinton/Bengio带头支持,共推CoT监测方案

OpenAI、谷歌DeepMind、Anthropic联合发表立场文件,提出CoT监测概念,认为是控制AI Agent核心方法。探讨其潜在机遇、局限,还提及不同公司对CoT监测的不同态度,如OpenAI乐观,Anthropic焦虑。

量子位