英伟达GPU」共找到 1450 篇相关文章

新闻资讯7

曝GPT-5.5用上「全球最快芯片」,Claude慌了!

新智元报道,OpenAI的GPT - 5.3 - Codex - Spark用Cerebras的WSE - 3芯片2000 token/秒。Cerebras CFO称在跑GPT - 5.4和GPT - 5.5,但SemiAnalysis报告指出其跑大模型有短板,且公开云模型小、上下文短。

新智元
算法论文8

Test Time Scaling Law远未到上限! o4-mini仅15.8%通过率,华为诺亚提出代码HLCE终极基准

华为诺亚研究员推出全新编程基准HLCE,含235道竞赛难题。实验显示,顶级LLM在该基准表现不佳,推理模型优势大,IOI交互式题难攻克。研究还发现模型自我认知与推理能力发展不同步,Test Time Scaling Law远未上限。

机器之心
开源动态8

6.1B激活,三榜开源第一!蚂蚁·安诊儿医疗大模型发布

由浙江省卫生健康信息中心等联合研发的开源医疗语言模型AntAngelMed发布。它基于Ling - flash - 2.0,100B总参数仅激活6.1B约40B密集模型性能,在多个权威医疗基准测评中居前列,采用三阶段训练流程,高效MoE架构。

AIGC开放社区
产品应用8

国内首次!8.9毫秒推理速度破纪录,1元打穿百万token

在2025人工智能计算大会上,浪潮信息发布元脑SD200和元脑HC1000两款AI服务器。前者让DeepSeek R1的Token生成速度8.9毫秒,后者将推理成本降至1元/百万Token,解决了AI智能体速度与成本难题。

新智元
新闻资讯7

AI第一金主黄仁勋:日均花掉20亿

AI投融资火热,黄仁勋成最大金主。过去财年英伟投资175亿美元,今年已投400亿。投资风格是大手笔、广撒网,涵盖AI模型、算力、硬件等。偏爱OpenAI,投300亿,但与各实验室关系复杂,投资也有商业考量。

量子位
新闻资讯7

架构彻底重构!DeepSeek新模型代码曝光,要来的V4让国内外都坐不住了?

DeepSeek官方GitHub代码库曝光代号“MODEL1”新模型线索,或为V4内部代号。代码显示其有重大架构变更,能并行处理稀疏与稠密计算,适配英伟新架构。此前R1发布推动中国AI开源生态发展,新模型备受期待。

InfoQ
产品应用7

前百川联创下场、字节腾讯入局,到底谁在看好 AI 播客?

近期前百川智能联创焦可的‘来福’、前妙鸭相机产品负责人张月光的 ChatPods 等 AI 播客产品上线。‘来福’播客全由 AI 生成,国内多款同类产品也相继登场。虽产品效果能及格线,但在多数播客场景难替代现有内容。

Founder Park
新闻资讯7

Win11 已近乎“残废”?微软承认多个核心功能崩盘,锅要甩给 AI 编程吗?

近期微软麻烦不断,先是部分Microsoft 365服务故障,Windows业务负责人公布的计划也遭不满。英伟指出Windows 11更新影响游戏效能,微软承认其存在系统性问题,多个核心功能故障已持续四个月,官方正修复并给出临时方案,引发社区吐槽。

InfoQ
新闻资讯8

AI 的下一个战场:端侧模型崛起

大模型退烧,小模型接棒。腾讯、阿里等大厂纷纷官宣小模型成果,英伟、OpenAI 等也有相关动作。端侧模型赛道广阔,但技术含量不低,面壁智能在端侧模型探索上成果丰硕,其 MiniCPM 系列不断迭代,还在多领域落地。

AI科技评论
产品应用8

VLA进化后降维打击!双手拣货,漂移操作,还能批量化秀舞,太空舱直接开上街,被银河通用卷到了

世界机器人大会上,银河通用的人形机器人Galbot在具身智能小卖部营业,背后是自研端到端具身智能大模型。其与英伟联合首发的机器人应用表现出色,太空舱也在北京首发,适配多场景,具身大模型商用能力获认可。

量子位