英伟达GPU」共找到 1450 篇相关文章

开源动态8

英伟MoE新开源:一行import,微调加速3.7倍

英伟开源NeMo AutoModel,基于Hugging Face Transformers v5,不改代码API,添一行import就能更快速微调MoE模型。实验显示,它能提升3.4 - 3.7倍训练吞吐,减少29% - 32% GPU显存占用。

量子位
新闻资讯8

比肩英伟H20!阿里自研PPU浮出水面

1月29日,阿里旗下平头哥官网公布高端AI芯片“真武810E”信息,标志“通云哥”协同体系亮相。该芯片全栈自研,已服务超400客户。其PPU架构性能比肩英伟H20,性价比更高,阿里还支持平头哥探索独立上市。

芯师爷
算法论文7

英伟新研究:小模型才是智能体的未来

英伟最新论文指出,大模型在Agent任务中消耗大量计算资源,成本高、效率低、灵活性差,而小模型能在性能够用前提下让任务执行更经济灵活。小模型通过优化硬件资源和任务设计高效执行任务,但落地面临挑战。

量子位
新闻资讯7

惠州老板搭上英伟,公司市值半年飙涨1300亿

胜宏科技董事长陈涛白手起家,带领公司深度绑定英伟等头部客户。2024年营收超107亿,市值半年涨1300亿。今年公司积极融资扩张,同时高管减持引投资者担忧。

芯师爷
新闻资讯8

黄仁勋出手!45倍性能暴涨,英伟定义物理AI新纪元

在SIGGRAPH 2025上,英伟发布「物理AI」全家桶。展示完整生态,含新硬件、仿真平台和AI模型。如RTX PRO 6000服务器显卡性能涨45倍,还推多款模型,应用于多领域,推动物理AI落地。

新智元
新闻资讯7

英伟服务器涨价超15%!百亿AI基建的「内存难题」

据彭博社报道,英伟通知客户,搭载其AI芯片的服务器价格将涨超15%,2027年初生效。涨价主因是内存需求大增、供应紧张价格上涨,这让数据中心前期投入增加,小公司更难入局。

机器之心
开源动态8

开源即爆火!英伟重磅推出OmniVinci全模态大模型

英伟在华盛顿GTC大会开源OmniVinci全模态大语言模型,实现视觉、音频、语言统一理解。它性能超竞品,架构有创新,数据引擎庞大。实验有重要洞察,在多场景表现佳,代表全新AI范式。

机器之心
新闻资讯7

英伟重返中国!6月大量生产特供AI芯片,价格暴降40%

路透社消息,英伟为突破美出口限制,将为中国推特供AI芯片,6月量产,价格降40%。该芯片基于RTX Pro 6000D,简化设计以控成本和符合管制。虽计算力低,但CUDA生态有优势。

AIGC开放社区
新闻资讯7

苹果向英伟生态妥协了!MLX框架主动适配CUDA

苹果特意为端侧AI模型训练推出的MLX框架,主动增加了CUDA支持。因CUDA在AI开发领域占主导,且生态强大,苹果此举是借力英伟生态、扩大自身影响力的战略选择,也避免侵权。

量子位
新闻资讯8

英伟震撼首测Vera Rubin,DeepSeek吞吐暴涨30倍!

英伟公布下一代旗舰级机柜Vera Rubin NVL72片上实测数据,用DeepSeek - V4 - Pro跑任务,每兆瓦吞吐量最高升30倍、Token成本最高降35倍。还宣布Groq 3 LPX量产,推出Agent专属Vera CPU,被SpaceXAI采用。

新智元