GPU算力」共找到 1072 篇相关文章

产品应用8

登顶SuperCLUE DeepSearch,openPangu-R-72B深度搜索能力跃升

近日 SuperCLUE 发布 11 月 DeepSearch 评测报告,国产大模型 openPangu - R - 72B 名列第一。它采用 MoE 架构平衡效率与性能,经预训练技术优化和 DeepSearch 专项突破,彰显国产算力与大模型研发融合成效。

机器之心
开源动态7

OpenAI突然开源新模型!99.9%的权重是0,新稀疏性方法代替MoE

OpenAI悄悄开源新模型,0.4B参数且99.9%权重为零,是Circuit Sparsity技术的开源实现。该技术通过约束模型内部连接稀疏性,解决传统稠密Transformer黑箱问题,或让MoE模型走上末路,但目前算力成本极高。

量子位
新闻资讯8

Fable 5手搓首个CUDA「超级内核」!2.5小时狂飙18.7倍

GPU算子基准测试KernelBench - Mega中,Fable 5全程纯手搓CUDA,速度狂飙18.7倍,把GPT - 5.5甩开4倍多。它写出史上首个‘超级内核’,2.5小时约55万token完成编写。Anthropic联创称这标志‘RSI循环’开启。

新智元
开源动态8

迈向AI4S 2.0,上海AI实验室开源书生万亿科学大模型Intern-S1-Pro

2月4日上海人工智能实验室开源万亿参数科学多模态大模型Intern - S1 - Pro,为AI4S迈向2.0提供开源基座。其核心科学能力跃升,底层架构创新,科学与通用能力协同发展,还构建了‘算力 - 算法’一体化基座,推动科研范式革命。

OpenMMLab
新闻资讯7

谷歌创始人罕见反思:低估 Transformer,也低估了 AI 编程的风险,“代码错了,代价更高”

谷歌创始人 Sergey Brin 在斯坦福公开对话中反思,谷歌曾低估 Transformer 和 AI 编程风险。他认为 AI 写代码易出错,更适合创意类工作。还回顾谷歌发展,指出虽有研发积累,但曾投入不足,强调算法比算力更关键。

InfoQ
开源动态8

妈妈再也不用担心延迟了!斯坦福手搓Llama超级内核,推理仅需0.00068秒

斯坦福Hazy实验室推出低延迟推理引擎「Megakernel」,将Llama - 1B前向传播融入单一GPU内核,H100上提速1.5倍,B200上每次推理仅0.00068秒,比vLLM快3.5倍。文章分析传统引擎问题并介绍Megakernel设计。

新智元
产品应用8

华为超节点:用「一台机器」的逻辑,驱动AI万卡集群

在华为全联接大会2025上,华为基于自研灵衢互联协议创新超节点架构,重新定义大规模有效算力新范式。它能解决传统集群通信问题,还推出覆盖全场景的产品组合,并强调‘硬件开放、软件开源’生态战略。

机器之心
新闻资讯8

5Y News | 祝贺曦智科技今日登陆港交所!

4月28日,曦智科技-P在港交所主板挂牌上市,成全球AI硅光芯片第一股。上市首日股价涨幅大,市值达813亿港元。其由沈亦晨创立,在光电混合算力领域领先,募资将聚焦主业研发。

五源资本 5Y Capital
新闻资讯8

摩尔线程背后大赢家:早期投资人回报已超6200倍

摩尔线程今日登陆科创板,市值达2800亿。其自创立受资本关注,融资超百亿。沛县乾曜早期190万投资增值超6200倍。虽曾遇美国制裁危机,但仍业绩增长,彰显了国产GPU企业的突围能力。

芯师爷
新闻资讯7

100亿美元联姻,Meta与Google的AI云计算豪赌

近日,Meta与Google签署超100亿美元、为期六年的云计算协议,Meta用Google Cloud支持AI基建。该交易规模大,源于Meta算力需求迫切与Google TPU优势,也反映AI军备竞赛现状,预示行业新格局。

AIGC开放社区