「NVIDIA H100 GPU」共找到 773 篇相关文章
英伟达下一代GPU登场,Rubin CPX一次推理数百万Token,网友:这是头野兽
在周二的AI基础设施峰会上,英伟达宣布推出专为超100万token长上下文推理设计的Rubin CPX GPU。它将与其他产品组成新平台,性能卓越,还能复用现有平台,预计2026年底上市。
「国产GPU第一股」首秀!新架构下周揭秘,全栈底座不藏了
2025年12月19 - 20日,摩尔线程首届MUSA开发者大会将在北京举行。届时会揭晓新一代GPU架构与路线图,设20+技术专场,还有1000㎡科技嘉年华,展示全栈能力与生态进展。
不换GPU,性能飙升2.8倍!英伟达用软件暴打摩尔定律
2026年1月8日,英伟达官网披露,基于Blackwell架构的推理软件栈升级,让混合专家模型(MoE)推理效率迎「阶跃式」突破,单GPU吞吐飙升2.8倍,显著降低推理成本。其通过软件针对性升级发挥硬件潜力,还进行多项优化。
Temporal:Nvidia、OpenAI 都在用,为什么 Agent 还需要专门的长程任务工具?
本文编译了 Temporal CTO Maxim Fateev 的访谈。Temporal 提出 durable execution,确保工作流可靠执行,即使出错也能继续。它获 1.46 亿美元 C 轮融资,Nvidia、OpenAI 是客户。不过,它也面临 AI 发展和云厂商竞争等挑战。
英伟达确认恢复 H20 在中国销售,并推出面向中国的全新 GPU
7月15日英伟达官网发文,将恢复H20在中国销售,黄仁勋称正提交重售申请,美政府保证发许可证。还推出面向中国的全新GPU,强调AI成基础资源,致力支持开源研究等。
100亿美元!AI时代最闷声发财的两家公司,要合并了
《华尔街日报》报道,支付公司Stripe正与AI初创公司OpenRouter谈判收购事宜,价格达100亿美元。OpenRouter是全球规模最大的AI模型聚合平台,Stripe为科技公司提供底层金融服务。此次收购将扩展Stripe业务至AI生态。
颜水成领衔,给AI分段位!超100款多模态模型,无人达到L5
十所顶尖高校联合发布General - Level评估框架和General - Bench基准数据集,用五级分类制明确多模态通才模型能力标准。评估超100款模型,发现多数在L2 - L3,无L5模型,揭示当前模型不足。
5090将被秘密定位?美或强制植入「地理追踪」,锁定英伟达高端GPU
美参议员Tom Cotton提出法案,要求英伟达、AMD等高端GPU和AI芯片植入「地理追踪」功能,6个月后生效。法案覆盖多种产品,对芯片制造商是挑战,还为未来监管升级做铺垫。
老黄亲自打钱!马斯克一夜狂融1400亿,百万GPU豪赌AGI终局
马斯克的xAI获200亿美元E轮融资,英伟达等参投。xAI估值逼近OpenAI,手握超百万GPU,Grok 5在训。马斯克称2026年AGI降临,AI将冲击就业,xAI有望成谷歌对手,不过Grok也陷入‘脱衣’风波。
20000 GPU·h砸出 106 个SOTA模型架构:AI 科研进入“自我加速”时代
模型架构发现领域迎来突破,ASI - ARCH超级智能体无需人类预设搜索空间,完成科研闭环。经20000 GPU·h、1773次实验,发现106个超越人类SOTA的线性注意力架构,且已开源。