NVIDIA Rubin CPX」共找到 125 篇相关文章

算法论文7

现代GPU体系结构Cache Operators行为研究

本文基于Compute Capability 8.9的L20 GPU进行实验,对NVIDIA PTX Cache Operators行为做进一步探究,验证了STG指令命中L1 Cache时执行Write Through等结论,还提出了遗留问题待解决。

GiantPandaLLM
算法论文8

从视觉出发统一多模态!颜水成团队最新研究:不再把图像编解码器塞进LLM|ICLR'2026

NVIDIA研究员Jim Fan称AI正经历第二次预训练范式转移。颜水成团队Muddit模型从视觉先验出发,用离散扩散框架统一文生图、图生文和VQA,挑战多模态“语言中心论”,在多任务表现出色。

量子位
新闻资讯8

美国ATOM报告:Qwen称霸武林,中国统治开源世界

美国ATOM报告显示,2025年夏中国开源语言模型超美国,下载、使用量差距显著。Qwen成王者,DeepSeek在大模型领域表现出色。新势力如Nvidia、OpenAI等也在追赶,报告引入新指标衡量模型热度。

AIGC开放社区
新闻资讯8

黄仁勋最新访谈:我们已经实现了 AGI,领导力、心理学、生命、意识、死亡和人性

黄仁勋在 Lex Fridman 播客深度对话中,谈及 CUDA 决策、管理模式、四层 Scaling Law 等多话题。认为已实现 AGI,编程定义改变,程序员会增多,还分享对供应链、开源等看法。

AGI Hunt
产品应用8

刚刚,霸榜神秘视频模型身份揭晓,原来它就是「David」

几天前登上Artificial Analysis榜首的神秘视频模型揭晓,是Runway最新发布的Gen - 4.5。它树立行业新标杆,在多方面表现出色,但也存在一些视频模型常见的局限性,Runway正探索解决办法。

机器之心
新闻资讯7

一场直播,10万人被骗!「AI黄仁勋」比真人火8倍

在GTC 2025大会上,黄仁勋登台演讲,英伟达官方直播在线人数仅1.2万,而打着「NVIDIA LIVE」旗号的假直播却聚集近10万观众,AI生成的「黄仁勋」搞诈骗,数千人被骗82万。

新智元
算法论文8

谷歌之后,英伟达入局扩散大语言模型,Fast-dLLM推理速度狂飙27.6倍

大语言模型领域,推理效率制约实际应用。谷歌Gemini diffusion曾展扩散模型并行潜力,但开源扩散LLM推理慢。近日,NVIDIA等推出Fast - dLLM,无需训练即插即用,推理速度狂飙27.6倍,兼顾速度与精度。

机器之心
新闻资讯7

刚刚,SpaceX、英伟达宣布:AI数据中心要上天了

SpaceX与英伟达合作设计Starmind AI1卫星计算载荷,每颗卫星搭载NVIDIA GPU和CPU,将数据中心算力部署太空,该设计也用于地面数据中心。但项目投入大,还面临管理集群等难题。

机器之心
新闻资讯8

硬刚黄仁勋!AMD祭出「千倍算力大杀器」,「反黄联盟」崛起

CES现场,苏姿丰投下震撼弹:四年内AI算力将提升1000倍! 面对英伟达的封锁,AMD不再隐忍,直接祭出Helios「太阳神」机架与MI455X芯片,以单代性能暴涨10倍的「暴力美学」正面硬刚。

新智元
产品应用8

ZeroGPU Spaces 加速实践:PyTorch 提前编译全解析

本文聚焦 ZeroGPU Spaces 加速实践,介绍 PyTorch 提前编译。ZeroGPU 使在 Hugging Face Spaces 用 Nvidia H200 硬件更高效,但有局限。提前编译可优化模型,提升演示速度,还分享了接入方法、高级技巧及演示示例。

Hugging Face