高性能计算」共找到 3879 篇相关文章

新闻资讯7

Altman拿Token换股权只够烧45天,20亿Token捐母校只值100块:Token真成“钱”了,谁更赚?

本文围绕AI Token展开,讲述OpenAI用Token换创业公司股权,00后捐20亿Token给母校,还探讨了“tokenmaxxing”现象及问题,指出AI行业经济账未算清,企业客户成本,AI成管理层压迫工具。

InfoQ
新闻资讯8

Gemini 3.5来了!今夜,谷歌亲手淘汰谷歌

谷歌I/O 2026大会火力全开,发布Gemini Omni、3.5 Flash、Spark等新品。Omni可接收任意输入生成视频,3.5 Flash性能强大,Spark是7×24h云端个人AI特工。谷歌多项能力同时到位,撕开了ASI入口。

新智元
产品应用8

牛芯国产先进工艺 DDR5/LPDDR5 IP双双突破6400Mbps

随着人工智能等领域发展,系统对数据吞吐能力需求攀升。牛芯半导体基于国产先进工艺研发DDR5/LPDDR5 IP,实现6400Mbps性能验证,通过创新弥补工艺代差,打通国产链路,具成本和安全优势。

芯师爷
新闻资讯8

「美队」老黄深夜扔出地表最强GPU!算力百倍狂飙,下次改演雷神

凌晨,老黄GTC主题演讲华盛顿首秀,亮出下一代GPU核弹Vera Rubin,性能狂飙100倍。目前,Blackwell已全面量产,2026年底两大GPU王牌预计爆赚5000亿美金。此外,英伟达还公布了一系列合作与技术创新。

新智元
算法论文8

半在线RL新范式UI-S1,使得GUI Agent既稳定又规划长远

现有AI训练方法在GUI自动化中各有弊端,本文提出半在线强化学习范式,训练出UI - S1 - 7B模型,性能提升显著,还提出新评估指标SOP,是迈向实用化AI智能体的重要一步。

深度学习自然语言处理
技术分析类文章7

Pingpong Schedule并不是万能钥匙

SGLang社区开发者反馈,SM90 FP8 Blockwise Scaling Grouped GEMM从H20迁移至H800后性能下降。文章分析是Pingpong调度策略所致,因算力提升,其使TensorCore未充分利用、TMA效率低,建议用Cooperative策略。

GiantPandaLLM
算法论文8

TreeHop:无需LLM的效多跳问答新范式

多跳问答(MHQA)任务有挑战,现有方法依赖LLM,计算成本、延迟显著。TreeHop研究提出新方案,摒弃LLM,通过嵌入空间动态更新,降低延迟、减少模型参数量,还在主流数据集表现佳,适合工业应用。

深度学习自然语言处理
8

中国游戏行业:产业结构、薪酬体系与核心人才需求分析

文章分析中国游戏行业,指出其已成为复杂数字经济体,2024年市场收入稳健增长。发展历经多阶段,AIGC等技术带来变革。商业模式以F2P与内购为主,“研运一体”是关键。行业薪酬有竞争力但工作强度,版号影响深远。

AI Reading Hub
推荐文章8

NVIDIA技术沙龙 《大规模EP优化:PD分离MoE并行方式》课程笔记

本文是NVIDIA技术沙龙课程笔记,介绍大规模EP优化的PD分离MoE并行方式。涵盖PD分离、大规模专家并行等五项关键技术创新,还对比多模型架构,展示推理服务架构性能特点与优化策略,以及各技术工作流程和效果。

GiantPandaLLM
新闻资讯7

OpenAI「辣椒芯」干翻英伟达!老黄股价不跌反涨

OpenAI自研芯片「小辣椒」跑分碾压英伟达最强blackwell,低延迟、吞吐、低并发等全达SOTA级别。但英伟达股价未跌反涨,OpenAI也表态不会弃用英伟达。「小辣椒」预计2027年量产,OpenAI还将开发后续版本,不过其数据中心负责人离职,无人接手。

量子位