算法论文8
英伟达 Jet - Nemotron 模型实现 53.6 倍吞吐提速
机器之心
AI 摘要
英伟达推出新混合架构语言模型 Jet - Nemotron,性能超 Qwen3 等开源模型,H100 GPU 上生成吞吐量最高提 53.6 倍。它基于 PostNAS 和 JetBlock 创新,兼顾精度与效率。
阅读原文 · 机器之心
英伟达再出手!新型混合架构模型问世,两大创新实现53.6倍吞吐提速
英伟达研究者提出新混合架构语言模型 Jet - Nemotron,在达 SOTA 全注意力模型精度时效率卓越,2B 版性能超 Qwen3 等,H100 GPU 上生成吞吐量最高加速 53.6 倍,基于 PostNAS 和 JetBlock 两大创新。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
新闻资讯7
黄仁勋15亿押注,OpenAI独霸核废墟AI厂20年
英伟达、OpenAI和软银要将美国俄亥俄州冷战核废墟改造成全球最大AI超级工厂,终极电力规划达8吉瓦。黄仁勋宣布注资、担保,OpenAI签长约,孙正义改造电网,这或成稳赚买卖。
新智元
新闻资讯7
英伟达推 AI 智能体 CPU,消费者或为产能变化买单
2026 年英伟达宣布量产为 AI 智能体打造的 CPU Vera。此前 AI 产业硬件焦虑多围绕 GPU,如今 AI Agent 改变任务形态,CPU 负担加重,芯片厂商纷纷布局,产能变化或让消费者买单。
DeepTech深科技
新闻资讯7
黄仁勋锁定OpenAI 20年芯片收入
英伟达推出‘LPS’概念,联合投资机构出5000亿美元建数据中心,为客户担保。首个项目为在美为OpenAI建150万GPU数据中心,20年或带来巨额芯片收入。黄仁勋也对相关风险做了澄清。
量子位
新闻资讯8
英伟达联手OpenAI,狂卷16GW算力霸权
英伟达宣布亲自下场锁定土地、电力和厂房等资源建超级AI工厂。与SB Energy联手在美拿下LPS容量,租客是OpenAI。文章分析合作原因、价值,解答外界疑问,称英伟达成全栈AI基建平台。
AI寒武纪