「计算加速」共找到 1222 篇相关文章
智算浪潮下的专有云操作系统安全:范式跃迁与信任链重塑
云计算发展使专有云成企业平衡便利与安全之选,但 AI 冲击其安全范式。阿里云三位专家探讨 AI 时代专有云安全,涉及物理隔离价值、新技术重塑安全逻辑、国产 OS 与芯片协同挑战等,还介绍阿里云方案及未来趋势。
AI竞赛下半场:为什么说“超级工厂”是最优解?
2025年夏天,巨头们因Agent的崛起对AI热情高涨,砸钱堆算力的背后是算力供不应求的困境。云计算因其具备极致的规模化、先进的生产工艺、柔性生产、智能管理和生态链接能力,被认为是AI的“超级工厂”。阿里云作为实例,展示了其完整的AI生产体系。
谈一谈TP推理场景下MoE Group GEMM的优化思路
作者在使用H20测试SGLang CUTLASS MoE时,发现其在中小Batch Size场景下性能不佳。为此设计Expert Specialization方案,启动多个不同配置Kernel,依Expert计算特性选合适的。还介绍了该方案在H20和Hx00上的实现细节及性能测试结果。
驾驭AI的人,才是穿越周期的竞争力|2026极客时间DTDS大会圆满落幕
2026年5月极客时间企业版联合《培训》杂志举办DTDS大会,四位产业一线实践者拆解企业AI转型难题。协鑫科技张诗笳给出AI人才培养体系;赵钰莹发布8大岗位AI技能图谱;广新集团李志刚分享创新加速三步法;黄林给出未来趋势判断与诊断模型。
一个Dispatch Dtype引起的fp8 quant kernel性能问题
文章记录SGLang社区在sgl-kernel中解决的fp8 quant kernel性能问题,因错误使用`c10::Float8_e4m3fn`数据类型,未用硬件加速指令,通过软件调用致性能下降,现已修复,vLLM也应用此修复。
AI开始接管实验室了!玻尔·跃迁实验室:试剂、设备、数据一个入口搞定,1800+设备即插即用
深势科技推出玻尔·跃迁实验室,解决传统实验室设备割裂、经验依赖、数据离散、部署低效等痛点,围绕计算 - 实验 - 数据 - 计算无缝闭环底层重构,与传统 ELN/LIMS 不同。
AGI新技术路线:下一代稀疏注意力机制Monte Carlo Attention开源
超对称技术公司开源了 Monte Carlo 注意力机制,用于新版基座模型 BigBang - Proton。它在二进制块编码技术上,用块间代表交流机制实现线性复杂度,解决了传统方法的缺点,可实现理论上无限的上下文长度,对现有预训练技术和硬件设计影响深远。
伏曦量子完成天使及天使+轮融资,五源资本、启盈同创等跟投
近日,伏曦量子宣布完成天使及天使+轮融资,由全球动力电池行业龙头领投,多家机构跟投。该公司由赵琦博士创立,定位是帮助产业客户理解和使用量子算力,其核心价值是优化算法,让问题可在近期硬件测试。
Nvidia GPU深度解析
文章深度解析Nvidia的B30A(传闻)、HGX H20、H100、B200和B300(Ultra)五款GPU,从架构、性能、内存、封装工艺和应用场景等方面对比差异,助读者选合适GPU。
EMNLP 2025 浙大&蚂蚁 | 提出动态压缩CoT推理新方法:LightThinker
随着AI发展,大语言模型处理复杂推理任务能力提升,但推理时产生大量中间步骤和文本,拖慢计算速度、增加资源压力。浙大、蚂蚁等机构研究者提出LightThinker,可动态压缩推理步骤,降低内存占用和计算成本。