推荐文章7
小枣君揭秘FP32、FP16、INT8
芯师爷
AI 摘要
鲜枣课堂小枣君:FP32、FP16、INT8是数字存储格式,位数多则范围大、精度高但效率低,不同场景按需选用。如今算卡厂商追求支持全数据类型,未来低精度格式或更普及。
阅读原文 · 芯师爷
小白必读:到底什么是FP32、FP16、INT8?
文章介绍FP32、FP16、INT8等数字存储格式类型。指出它们是评估算力前提,不同格式在精度、范围、内存占用和计算速度上有差异,还提及多精度与混合精度计算,以及不同硬件对格式的支持情况。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
推荐文章8
金煜阳:大模型推理加速全链路方案揭秘
本文整理自金煜阳博士在QCon大会分享。介绍大模型推理挑战,如规模增大、架构复杂。阐述算子优化、内存管理、量化、异构调度和并行优化方法,还介绍开源推理引擎赤兔在国产芯片的实践成果。
InfoQ
开源动态8
EdgeRazor:端侧大模型解码加速15倍
大语言模型参数膨胀,端侧部署难,量化成主流轻量化方案。开源工具库EdgeRazor由南京大学和微软联合推出,采用MPQAD打破极低比特大语言模型“能力塌陷”,在性能、效率、易用性等方面表现出色,打通AI全生态链路。
机器之心
开源动态8
Transformers v5发布,成AI生态通用语言
Transformers v5发布,通过极简定义和极致互通成AI生态核心。它做减法重构代码、拓展训练流程、成推理引擎弹药库、提升量化为核心功能,连接训练、推理与部署,是AI生态通用语言。
AIGC开放社区
算法论文8
纽约大学QSVD让VLM更小更快更准
纽约大学研究团队用QSVD新方法让视觉语言模型(VLM)效率飞跃,在普通GPU上实现13.1倍加速。它将Q、K、V矩阵捆绑处理,设计秩分配策略,引入量化方案,经多模型评估,展现出低硬件成本、高精度优势。
AIGC开放社区