NVIDIA GPU」共找到 474 篇相关文章

新闻资讯7

苏姿丰出手!Oracle下单5万颗AMD芯片,英伟达王座撼动

Oracle宣布2026年第三季度起在云基础设施部署5万颗AMD Instinct™ MI450系列GPU构建AI超级集群并持续扩容。AMD Instinct MI450系列GPU亮点多,此次合作是其与Oracle合作的深化,也被视为AMD挑战英伟达的关键突破。

新智元
产品应用7

【CUDA 博客】TMA简介 & 让矩阵转置在Hopper GPUs上变得更快

文章介绍Hopper GPU新特性TMA,它能高效传输多维数组数据。文中展示用TMA对2D数组操作,如创建张量映射、编写kernel等。还讲了避免共享内存bank冲突的交织方法,最后介绍在Hopper GPU上实现高效矩阵转置的多种方式及性能。

GiantPandaLLM
新闻资讯7

算力租赁要变天了

去年华尔街就算力巨头折旧问题起争议,大空头Michael Burry称其通过延长AI服务器折旧周期虚增利润。随着英伟达GPU迭代周期缩短,折旧时间应缩短。Coreweave靠出租GPU盈利,以其为抵押物的巨额贷款引发争议。Meta出租闲置算力或冲击Coreweave等公司。

远川科技评论
算法论文8

全新GPU高速互联设计,为大模型训练降本增效!北大/阶跃/曦智提出新一代高带宽域架构

随着大模型参数规模扩大,分布式训练成关键路径,高带宽域设计对提升训练效率至关重要。现有HBD架构在可扩展性、成本和容错能力等方面有局限,北大、阶跃、曦智团队提出InfiniteHBD架构解决问题。

量子位
新闻资讯8

老黄在CES 2026 上预言:将要告别应用软件的预编译时代,未来的应用是 GPU 上实时生成每一个像素

黄仁勋在CES 2026预言,应用将告别预编译时代,在GPU上实时生成像素。他回顾2025年AI关键进展,介绍Agentic AI特点与能力,还谈了其搭建及应用前景,指出未来软件或基于Agent交互。

宝玉AI
新闻资讯7

刚刚,H20重返中国!老黄亲自斡旋,还有特供版RTX PRO

英伟达官宣恢复向中国销售H20,并推出全新NVIDIA RTX PRO GPU。此前H20因贸易限制被禁售,此次解禁或是老黄来华大礼。不过H20已属‘上个时代产物’,且有新‘继任者’B30。

新智元
算法论文8

韩松等提出FlashMoBA,比MoBA快7.4倍,序列扩到512K也不会溢出

今年2月月之暗面提出MoBA,在处理长上下文有潜力,但业界缺乏对其性能设计原则的理解和高效GPU实现。来自MIT、NVIDIA的研究者提出FlashMoBA,解决了小块MoBA性能挑战,实验显示其在多方面表现优。

机器之心
新闻资讯7

一夜变天!谷歌一刀砍向两巨头:奥特曼急了,黄仁勋慌了

最近谷歌重回AI舞台中央,左手TPU拆解英伟达芯片暴利,右手Gemini 3围剿OpenAI流量帝国。谷歌高管称「Gemini 3开启智能新纪元」,在多项基准测试中超越GPT - 5。Nvidia和OpenAI面临严峻挑战,AI三国混战已开始。

新智元
新闻资讯7

内存价格,要被老黄的1000亿空头支票打下来了

AI界「闺蜜情」现裂缝,NVIDIA曾宣布向OpenAI投资1000亿美元用于建设AI数据中心,这使内存价格起飞。如今投资搁置成空头支票,双方还互有不满,OpenAI自身状况也不佳。

芯师爷
开源动态7

110万美元悬赏!AMD发起全球战书:谁能打破DeepSeek与Kimi的推理速度极限?

AMD与GPU MODE联合发起2026线上黑客松,向全球发榜。挑战赛设110万美元奖池,分预选赛和决赛,要对核心GPU算子打磨、挑战明星模型,代码须可合并,给出了赛程安排及参赛方式。

AI科技大本营