计算芯片」共找到 1231 篇相关文章

推荐文章7

【博客转载】CUDA Reduction

文章来自Lei Mao,介绍CUDA归约操作。先阐述归约操作在并行计算中的常见性,接着实现两个批量归约求和kernel,还给出构建和运行示例的命令及结果。最后探讨大数组归约求和的方法及性能影响。

GiantPandaLLM
开源动态8

让世界模型推理效率提升70倍:上海AI Lab用“恒算力”破解长时记忆与交互瓶颈

上海AI Lab联合多家机构开源Yume1.5,针对视频生成构建可交互“世界模型”的核心难题,提出时空信道联合建模(TSCM),实现近似恒定计算成本的全局记忆访问,展示了世界模型工程化落地的可行路径。

量子位
8

高通祭出全球最快移动SoC!卢伟冰携全球首发小米17Pro现身

2025骁龙峰会·中国会场,高通推出第五代骁龙8至尊版移动平台,采用台积电3nm制程。小米17系列将全球首发,多家厂商也会搭载。该芯片在CPU、GPU、NPU等多维度性能提升,还在影像、音频和通信方面有飞跃。

机器之心
8

纯CPU“踢开”GPU,中国超算九年后再登顶!

6月23日,国家超级计算深圳中心“灵晟”超算以2.19EFlops性能登顶全球超算TOP500榜单,这是世界首台超2EFlops的超算系统。它基于“灵鲲”平台,采用纯CPU设计,展现我国超算全栈自主可控能力。

芯师爷
新闻资讯8

用 Astra+Codex 干掉 CUDA!奥特曼9个月AI造芯反杀英伟达 GB300

北京时间昨日凌晨,OpenAI 公布自研推理芯片 Jalapeño 实测结果,其在多指标挑落英伟达 GB300。OpenAI 用 GPT - 6 和加强版 Codex 造芯,9 个月完成硬件设计优化,3 个月搞定软件栈,威胁英伟达 CUDA 根基。

AI前线
推荐文章7

GPU到底是如何工作的?这篇AI Infra入门全部告诉你

本文详细介绍了GPU工作原理及编程模式。它从图形渲染发展到GPGPU,NVIDIA推动其通用计算。还阐述了CPU/GPU异构架构,对比二者性能,介绍编译、加载、启动过程,以及GPU硬件架构、编程与执行模型,分析SIMD和SIMT。

腾讯技术工程
新闻资讯7

成熟工程师1天完成调试,AI工程实践被MCP彻底颠覆?

去年11月Anthropic发布模型上下文协议(MCP),开发者社区迅速采用,AWS、GitHub、OpenAI等也已采用。MCP标准化数据和工具与AI代理的集成,简化定制化AI应用构建。采访华院计算杨小东,解析其架构、应用及商业价值。

AI前线
新闻资讯8

英伟达再创历史纪录!Q1收入增长69%,数据中心贡献89%,游戏业务大涨42%

英伟达2026财年Q1财报亮眼,总收入441.1亿美元,环比增12%、同比涨69%。数据中心和游戏业务表现出色,分别占比近89%、创新高。不过H20芯片受出口限制影响,预计二财季收入减80亿美元。

量子位
新闻资讯7

从 Apple M5 到 DGX Spark ,Local AI 时代的到来还有多久?

近期,黄仁勋将桌面级AI超算DGX Spark交付给马斯克引发热议。同时,Apple Silicon等芯片下放端侧推理能力,本地运行时和端侧模型供给加速成熟。但本地算力等问题仍制约消费终端Local AI大众化落地。

机器之心
新闻资讯8

OpenAI总裁底牌全交了:买下地球上所有的算力

OpenAI总裁Greg Brockman接受访谈,核心观点是世界长期缺算力。他指出算力需求远未释放,H100涨价凸显供应紧张,OpenAI要全买光算力、自研芯片,还谈到价格与利润、产品形态、智能体应用及医疗领域潜力等。

AI寒武纪