新闻资讯8
英伟达新模型上线,推理速度狂飙53倍
新智元
AI 摘要
英伟达推出小模型系列Jet - Nemotron,由全华人团队打造。提出PostNAS与JetBlock创新,相比Qwen3等模型,多维度准确率更高,H100 GPU推理吞吐量最高提53倍,解码可达50倍提升。
阅读原文 · 新智元
刚刚,英伟达新模型上线!4B推理狂飙53倍,全新注意力架构超越Mamba 2
Jet - Nemotron是英伟达推出的小模型系列(2B/4B),由全华人团队打造。其提出PostNAS与JetBlock,实现架构优化。相比Qwen3等模型,它在多维度准确率更高,H100 GPU上推理吞吐量最高提升53倍。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
新闻资讯7
黄仁勋15亿押注,OpenAI独霸核废墟AI厂20年
英伟达、OpenAI和软银要将美国俄亥俄州冷战核废墟改造成全球最大AI超级工厂,终极电力规划达8吉瓦。黄仁勋宣布注资、担保,OpenAI签长约,孙正义改造电网,这或成稳赚买卖。
新智元
新闻资讯7
英伟达推 AI 智能体 CPU,消费者或为产能变化买单
2026 年英伟达宣布量产为 AI 智能体打造的 CPU Vera。此前 AI 产业硬件焦虑多围绕 GPU,如今 AI Agent 改变任务形态,CPU 负担加重,芯片厂商纷纷布局,产能变化或让消费者买单。
DeepTech深科技
新闻资讯7
黄仁勋锁定OpenAI 20年芯片收入
英伟达推出‘LPS’概念,联合投资机构出5000亿美元建数据中心,为客户担保。首个项目为在美为OpenAI建150万GPU数据中心,20年或带来巨额芯片收入。黄仁勋也对相关风险做了澄清。
量子位
新闻资讯8
英伟达联手OpenAI,狂卷16GW算力霸权
英伟达宣布亲自下场锁定土地、电力和厂房等资源建超级AI工厂。与SB Energy联手在美拿下LPS容量,租客是OpenAI。文章分析合作原因、价值,解答外界疑问,称英伟达成全栈AI基建平台。
AI寒武纪