GB200」共找到 182 篇相关文章

新闻资讯7

Meta 即将上线全球最大算力集群

小扎在算力投入上毫不手软,Meta 即将上线全球首个 1GW+ 能耗的超级计算机机群,还在新建 Hyperion 算力集群,几年内功耗将达 5GW,远超老马 30 万张卡集群的 200 - 300 兆瓦。

歸藏的AI工具箱
新闻资讯7

OpenClaw中国行北京站落幕,3万人围观养虾,本周12城活动继续

2026年3月21日,OpenClaw中国行首站北京站举办,近200名开发者参与,直播间3万多人围观。活动上开发者30分钟可跑通AI应用,多位嘉宾分享使用经验,本周末将在12城继续开展。

AI前线
产品应用8

50万个AI生成的应用,正在赚钱

在2025秒哒创造者大会上可知,“三无”AI生成应用已诞生50万个商业应用,覆盖200多个细分领域。如“荣堂古村数字博物馆”等,它们变现能力强。秒哒是相关工具,操作简单,技术体系完整。

量子位
产品应用8

OpenAI 发布公司领导者 AI 行动指南,助力企业发展

OpenAI 2024 年走访超 200 家营收 10 亿美元企业,发现拖慢 AI 落地的是‘领导层叙事缺口’。结合客户实践,总结出对齐、激活、放大、加速、治理 5 个可落地步骤,助企业构建以 AI 为核心的组织。

带你学AI
开源动态8

2G 内存跑 Gemma 3n 完整版!全球首个 10B 内模型杀疯 LMArena:1300 分碾压记录

当地时间6月26日,谷歌正式发布Gemma 3n完整版,可在本地硬件运行。它是开源大模型,具多模态能力,最低2GB内存设备就能跑,E4B模型LMArena测评表现佳,还有MatFormer架构等多项创新。

AI前线
产品应用8

GPU利用率不到15%,AI产业最大的浪费正在被这家公司改写|甲子光年

AI产业发展中算力成本高、利用率低问题凸显。趋动科技押注‘软件定义GPU’,试图把独占GPU变为共享算力池,其产品使客户GPU利用率平均提升约4倍,已服务超200家头部客户。

甲子光年
开源动态8

Kimi K2 Thinking突袭!智能体&推理能力超GPT-5,网友:再次缩小开源闭源差距

Kimi K2 Thinking发布并开源,主打“模型即Agent”,能边思考边用工具,连续工具调用200 - 300次。在多评测基准超GPT - 5等闭源模型,代码权重遵循MIT协议,可在官网和应用实测。

量子位
开源动态8

SGLang 优化Triton FusedMoE 的一个新技巧​

蚂蚁在SGLang中提交优化PR,针对Fused Triton MoE的Down Projection kernel加入TMA优化,在DeepSeek - R1模型的H200 TP8 prefill场景下性能提升显著,还详细分析了优化背景、思路、实现细节及测试结果。

GiantPandaLLM
技术分析类文章7

Pingpong Schedule并不是万能钥匙

SGLang社区开发者反馈,SM90 FP8 Blockwise Scaling Grouped GEMM从H20迁移至H800后性能下降。文章分析是Pingpong调度策略所致,因算力提升,其使TensorCore未充分利用、TMA效率低,建议用Cooperative策略。

GiantPandaLLM
新闻资讯7

内存条涨疯了,国产替代如何破局?

2025年三季度以来,全球存储芯片市场涨价,32GB内存条价格疯涨,分析机构预测后续还会再涨。国际存储巨头赚得盆满钵满,下游厂商叫苦。本轮涨价因人工智能兴起,中国存储芯片有被“卡脖子”风险,国产替代挑战大。

芯师爷