GPU资源消耗」共找到 894 篇相关文章

新闻资讯8

老黄All in物理AI!最新GPU性能5倍提升,还砸掉了智驾门槛

英伟达CEO黄仁勋在CES 2026发布AI新品,全力搞AI。推出下一代Rubin架构GPU,性能大幅提升;发布五大领域成果,含新模型家族、平台等;还开源训练框架与多模态数据集,国产开源模型被提及。

量子位
新闻资讯7

硅谷GPU蒙尘,马斯克一言成谶:美国AI被电卡脖子

彭博社消息,加州圣克拉拉两处数据中心空置6年多等电力,凸显美国科技行业缺电问题。此前微软纳德拉承认缺电致GPU吃灰,马斯克也曾预言芯片或超供电能力。电力短缺制约数据中心发展,影响美国AI前进。

新智元
产品应用7

Deepseek 正式发布 V3.1:混合推理,Agent能力大幅提高,token消耗减半

Deepseek正式发布Deepseek V3.1,采用混合推理,支持双模式切换,上下文扩展到128k,API支持Claude Code调用。工具与Agent能力提升,思考效率更高,token消耗减半,官方渠道全面升级,9月6号起调整价格。

AI寒武纪
开源动态8

9.7K Star 把 AI 编码的 token 消耗砍了 16 倍

当前AI编码工具默认读取整个项目文件,token消耗高。code-review-graph项目用Tree-sitter解析代码库成图,追踪改动“爆炸半径”,平均省8.2倍token,技术轻量,还能做社区检测。它揭示AI编码瓶颈在信息输入质量。

CourseAI
推荐文章7

小模型代替顶级闭源:微软用4B小助理,砍掉30% Token消耗

微软研究团队提出实用方案,用4B参数的微型模型Terminus - 4B替换昂贵顶配大模型接管终端执行任务,采用SFT和RL策略打造子智能体,经测试效果良好,节省Token消耗

AIGC开放社区
新闻资讯8

英伟达,全球首个5万亿美元公司诞生!「GPU帝国」超日本德国GDP

英伟达市值突破5万亿美元,成全球首家达此里程碑公司,超德国和日本GDP。黄仁勋预计2026年GPU销售额达5000亿美元。GTC大会围绕‘AI工厂’展开,英伟达在多领域布局,搭建庞大AI帝国。

新智元
新闻资讯8

英伟达下一代GPU登场,Rubin CPX一次推理数百万Token,网友:这是头野兽

在周二的AI基础设施峰会上,英伟达宣布推出专为超100万token长上下文推理设计的Rubin CPX GPU。它将与其他产品组成新平台,性能卓越,还能复用现有平台,预计2026年底上市。

机器之心
新闻资讯7

「国产GPU第一股」首秀!新架构下周揭秘,全栈底座不藏了

2025年12月19 - 20日,摩尔线程首届MUSA开发者大会将在北京举行。届时会揭晓新一代GPU架构与路线图,设20+技术专场,还有1000㎡科技嘉年华,展示全栈能力与生态进展。

新智元
新闻资讯8

不换GPU,性能飙升2.8倍!英伟达用软件暴打摩尔定律

2026年1月8日,英伟达官网披露,基于Blackwell架构的推理软件栈升级,让混合专家模型(MoE)推理效率迎「阶跃式」突破,单GPU吞吐飙升2.8倍,显著降低推理成本。其通过软件针对性升级发挥硬件潜力,还进行多项优化。

新智元
算法论文8

EMNLP2025 | 探究大语言模型的语言共享神经元提升低资源语言能力

论文提出BridgeX - ICL方法提升LLM低资源语言性能,通过三步实现优化。构建两类探测数据解决传统问题,识别重叠神经元,用HSIC选最优桥梁语言,在多任务实验验证其有效,揭示多语言机制规律。

深度学习自然语言处理