「CPU延时」共找到 82 篇相关文章
内核级的真相:为什么 eBPF 正在取代基于用户空间的 Agent 成为安全可观测性的首选
文章指出基于用户空间的安全 Agent 存在与威胁同权限层级、CPU 成本高、易被攻击等问题。eBPF 能在 Linux 内核运行受沙箱保护程序,可降成本、增可见性。上线应分阶段,还介绍工具及部署安全措施。
对话蚂蚁吴伟:训推一体池化调度,如何把GPU用到极限
AICon大会前,与蚂蚁集团吴伟深度对话,探讨GPU资源调度解法。他指出CPU和GPU有结构性差异,只在推理或训练内优化有资源闲置,国产卡缺全链路生态,软件优化有天花板。还分享架构思路、算法及落地效果等。
一文读懂:GPU到底是怎么工作的?
文章详细介绍GPU工作原理,对比其与CPU差异。指出GPU擅并行计算、能解决复杂问题,还分析FLOPS、延迟、内存等因素对性能的影响,最后讲了GPU通过多线程和超量订阅获高吞吐量。
告别「边画边说」:LatentMorph 开启视觉生成隐式潜空间推理新范式
现有的文生图模型缺乏动态思考与自我修正能力,香港科技大学团队提出LatentMorph框架,将隐式潜空间推理集成到T2I生成过程中,实验显示其显著提升基座模型性能,削减推理延时与Token消耗,实现人机认知对齐。
时隔九年,中国超级计算机重登世界榜首
当地时间6月23日,第67届TOP500超级计算机排行榜发布,国家超级计算深圳中心的‘灵晟’(LineShine)夺冠,运算速度达2.198 ExaFLOP/S。它仅用CPU,性能超美国El Capitan超20%,引发对未来计算架构思考。
内存一年疯涨170%,云账单里的“隐性成本”该算清了
2025年下半年存储价格成焦点,DRAM合同价同比涨幅达171.8%,致企业IT采购成本上升。华为云更新Flexus云服务器系列,基于柔性算力技术,打破CPU与内存固定绑定,减少浪费,还引入应用级加速,提升性能。
92亿美元创纪录营收背后,AMD从英伟达手中“抢”走了什么?|甲子光年
美国当地时间11月4日,AMD公布2025财年第三季度财报,多项数据创纪录,已悄然抢夺英伟达在AI领域市场。其崛起基于GPU、CPU及软件层面战略部署,在中国市场也有独特策略,但转型仍面临风险。
万物皆可AI的时代?Arm发布全球首个Armv9边缘AI计算平台
Arm发布全球首个Armv9边缘AI计算平台,核心是Cortex - A320 CPU和Ethos - U85 NPU,能让小设备本地运行超10亿参数AI模型。边缘AI市场增长快,Arm转型切入,平台软硬结合优势明显,还有豪华朋友圈支持。
GPU到底是如何工作的?这篇AI Infra入门全部告诉你
本文详细介绍了GPU工作原理及编程模式。它从图形渲染发展到GPGPU,NVIDIA推动其通用计算。还阐述了CPU/GPU异构架构,对比二者性能,介绍编译、加载、启动过程,以及GPU硬件架构、编程与执行模型,分析SIMD和SIMT。
小红书 FinOps 实践:云成本优化与资源效率提升之道
在 InfoQ 举办的 QCon 全球软件开发大会上,小红书梁啟成分享云成本优化实践。介绍了小红书用云情况,分析成本优化面临的问题,阐述成本洞察和优化的探索,如内外账分离、CPU 和 GPU 资源提效等,还展望了 AI for FinOps 实践。