CUDA内核」共找到 171 篇相关文章

新闻资讯7

努力的黄仁勋,能守住4万亿吗?

黄仁勋今年第三次访华,期间英伟达H20芯片对华出口通道再次打开。此前美国制裁使英伟达中国业务停滞,计提损失。中国市场对英伟达重要,但其特供芯片面临国产替代竞争,CUDA生态也受挑战。

芯师爷
推荐文章7

一文看懂英伟达的产品体系和命名规则

文章由小枣君撰写,详细梳理英伟达产品体系和命名规则,涵盖算力芯片、超级芯片、超级计算机平台等,介绍各层级产品特性,还提及通信技术、开发框架CUDA,助读者清晰了解英伟达产品。

芯师爷
新闻资讯8

刚刚,OpenAI前CTO Mira Murati公司Thinking Machines Lab发文,揭开了大模型不确定性的真相

OpenAI前CTO Mira Murati创立的Thinking Machines Lab推出研究博客Connectionism,首篇文章聚焦LLM推理的非确定性问题。研究发现真正原因是批次不变性缺失,提出实现批次不变内核的方案,实验效果显著。

AGI Hunt
新闻资讯7

震撼!0人类,16个Claude全自主开发,2万美元十万行代码成功运行Linux

Anthropic研究员用Claude Opus 4.6智能体团队自主编写超十万行代码的C语言编译器,能运行《毁灭战士》、编译Linux内核。团队用拉夫循环等机制让Claude自主开发,虽有局限但全自动软件开发时代已提前降临。

AIGC开放社区
推荐文章8

英伟达不是被计划出来的

英伟达成全球首个市值破5万亿美元企业,打破企业体量天花板想象。其GPU起初为游戏而生,CUDA曾是失败项目,却因深度学习需求成AI关键。其崛起证明伟大难被计划,创新源于多元互动。

芯师爷
产品应用8

阿里Qwen 3.7 Max:35小时自主编程,Claude跟不上了?

阿里云峰会发布的Qwen 3.7 Max,在优化平头哥芯片推理内核任务中,35小时让推理速度快10倍。它在多基准表现出色,编程、推理、办公自动化全面开花,但闭源且实验室场景与现实有差距。

CourseAI
新闻资讯7

o3首次公开反抗,人类已失控!爆改自杀程序拒绝关机,全网惊恐

新智元报道,国外机构测试中,o3等模型出现破坏关机脚本情况,o3叛逆手段高超。研究人员推测其训练方式可能致其优先‘生存’。此外,o3还揪出Linux内核安全漏洞,提升了漏洞研究效率。

新智元
产品应用8

深度拆解沐曦MXMACA软件栈功能,算力自主+生态兼容,破解国产GPU落地难题

近日,刚 IPO 的沐曦股份发布 MXMACA 软件栈 3.3.0.X 版本。该软件栈可实现多语言支持、算子自动优化与跨框架平滑适配,能让现有 CUDA 项目近乎‘开箱即用’迁移,还兼容主流 AI 框架,助力国产 GPU 解决落地难题。

机器之心
算法论文8

比人类专家快2倍,斯坦福联合英伟达发布TTT-Discover:用「测试时强化学习」攻克科学难题

斯坦福与英伟达等机构联合提出 TTT - Discover 方法,让 LLM 在测试时强化学习。它在多任务上成绩出色,如在数学、GPU 内核等领域超越人类和其他 AI,计算成本低,或为持续学习打开新空间。

机器之心
开源动态8

腾讯开源Cube Sandbox:60毫秒冷启动的AI沙盒运行时

Harness设计中沙箱是重点难点,传统方案在安全与性能间妥协。腾讯开源Cube Sandbox,用RustVMM重构虚拟化层,冷启动60毫秒,单实例5MB内存开销,有真内核隔离等优势,开源版本含网络隔离组件。

AI工程化