H200芯片」共找到 845 篇相关文章

新闻资讯8

马斯克变身「算力包租公」!砸数万GPU疯狂喂养Cursor,联手反杀OpenAI

马斯克将xAI变成「算力包租公」,租数万GPU给Cursor训练模型,还挖来Cursor高管。同时,特斯拉AI5芯片流片成功,AI6也有规划,Dojo 3项目重启,他正用「硬件思维」重塑AI竞争格局。

新智元
开源动态8

MiroMind新模型超越GPT-5.4,三位顶尖AI科学家加盟

MiroMind发布MiroThinker - v1.7模型家族,在深度研究任务中表现出色,其专有智能体MiroThinker - H1超越多个顶级闭源模型。同时,三位顶尖科学家加盟,分别负责推理模型训练等方向,公司聚焦推理与可验证性。

AIGC开放社区
新闻资讯7

15年差评如潮,Siri终于有救了!苹果10亿真金白银投谷歌一票

苹果宣布和谷歌合作,用Gemini升级Siri等AI功能,此为过渡方案,苹果未来计划推自研1万亿参数模型。此前谷歌每年付苹果200亿做搜索,这次苹果或每年付10亿用Gemini。

新智元
新闻资讯8

硬刚黄仁勋!AMD祭出「千倍算力大杀器」,「反黄联盟」崛起

CES现场,苏姿丰投下震撼弹:四年内AI算力将提升1000倍! 面对英伟达的封锁,AMD不再隐忍,直接祭出Helios「太阳神」机架与MI455X芯片,以单代性能暴涨10倍的「暴力美学」正面硬刚。

新智元
新闻资讯8

Gemini 3.5来了!今夜,谷歌亲手淘汰谷歌

谷歌I/O 2026大会火力全开,发布Gemini Omni、3.5 Flash、Spark等新品。Omni可接收任意输入生成视频,3.5 Flash性能强大,Spark是7×24h云端个人AI特工。谷歌多项能力同时到位,撕开了ASI入口。

新智元
开源动态8

SGLang 优化Triton FusedMoE 的一个新技巧​

蚂蚁在SGLang中提交优化PR,针对Fused Triton MoE的Down Projection kernel加入TMA优化,在DeepSeek - R1模型的H200 TP8 prefill场景下性能提升显著,还详细分析了优化背景、思路、实现细节及测试结果。

GiantPandaLLM
新闻资讯7

硅谷GPU蒙尘,马斯克一言成谶:美国AI被电卡脖子

彭博社消息,加州圣克拉拉两处数据中心空置6年多等电力,凸显美国科技行业缺电问题。此前微软纳德拉承认缺电致GPU吃灰,马斯克也曾预言芯片或超供电能力。电力短缺制约数据中心发展,影响美国AI前进。

新智元
新闻资讯7

OpenAI「辣椒芯」干翻英伟达!老黄股价不跌反涨

OpenAI自研芯片「小辣椒」跑分碾压英伟达最强blackwell,低延迟、高吞吐、低并发等全达SOTA级别。但英伟达股价未跌反涨,OpenAI也表态不会弃用英伟达。「小辣椒」预计2027年量产,OpenAI还将开发后续版本,不过其数据中心负责人离职,无人接手。

量子位
新闻资讯7

暴涨3倍!光模块背后大赢家

2025年源杰科技股价表现强劲,年初迄今涨幅达348%,反超下游大客户中际旭创。其前三季度业绩爆发,得益于数据中心市场产品放量。随着AI算力需求爆发,光互连技术向CPO架构演进,对光芯片要求提高,源杰科技高端产品突破助其获利。

芯师爷
新闻资讯7

DeepSeek刚提到FP8,英伟达就把FP4精度推向预训练,更快、更便宜

DeepSeek提及针对国产芯片的FP8量化设计,引发对大模型量化策略关注。不久后英伟达发力低精度量化,将NVFP4策略拓展到预训练阶段,其方案能解决核心挑战,实验证明NVFP4在大规模训练中可行。

机器之心