存储税」共找到 207 篇相关文章

开源动态7

英伟达Run:ai没做到的,被华为开源方案实现了

传统存储难满足AI需求,存储需向‘智能存储’演进。华为数据存储团队推出系列产品和开源工具链,其Flex:ai对标Run:ai,更开源底层,能解决行业算力痛点,已在医院场景落地。

InfoQ
推荐文章7

【博客转载】CUDA Local Memory

文章围绕CUDA本地内存展开,介绍其为线程私有存储空间,访问特性与全局内存类似。通过两个计算滑动平均值的CUDA kernel示例,展示数组索引复杂度对存储位置的影响,还给出判断存储位置的方法及优化建议。

GiantPandaLLM
推荐文章8

模型压缩与量化:让大模型走向轻量化落地

文章介绍模型压缩与量化技术,其能在保持性能时降低大模型计算和存储需求,实现边缘设备高效部署。还阐述基础知识、关键技术路径、应用场景,并探讨未来发展方向。

机器学习AI算法工程
开源动态8

不想再折腾 ELK?上手体验,程序员自建监控新选择,前端埋点 + 后端日志 + 链路追踪,一套开源栈全包了

OpenObserve 是云原生开源观测平台,用一个服务搞定日志、指标等监控与可视化,能解决监控栈散、部署复杂、存储贵的问题,号称日志存储成本比 ES 降至约 1/140,功能亮点多。

小华同学ai
新闻资讯7

Cloudflare 如何将 Quicksilver 迁移到多级缓存并处理数十亿个请求

Cloudflare 工程团队分享将全局键值存储 Quicksilver 过渡到分层缓存架构的故事。从 V1 到 V2 迁移,采用多级缓存策略,解决存储、一致性等问题,提升性能,多数请求可在短时间内响应。

InfoQ
推荐文章7

《动手写AI Agent》会话与记忆:记住上次聊到哪了

文章围绕《动手写AI Agent》的会话与记忆展开,指出LLM无状态、无会话持久化会让对话记录丢失。介绍了解决方案,如把对话存到磁盘及构建长期记忆,阐述设计决策并提到文件系统存储方案。

AI Reading Hub
开源动态8

开源黑科技!向量数据库,居然要被 MP4 给干掉了!

GitHub开源项目Memvid,能用MP4视频文件替代昂贵的向量数据库,检索达亚秒级。它把文本编码成视频,用配套JSON索引记录位置,结合sentence-transformers和FAISS实现语义搜索,存储和检索性能出色。

AGI Hunt
新闻资讯7

内存涨价,千元机的天塌了

去年下半年起存储芯片涨价,因AI基础设施需求爆发,三大存储芯片厂产能被榨干。消费级产品供应受挤压,中低端手机成最大受害者,各厂商搁置低价产品线,中低端市场持续萎缩。

远川科技评论
新闻资讯7

全球第一!西湖大学成功登顶Science,卷赢同行背后黑科技揭秘

西湖大学一篇论文登顶Science,力压4篇同主题投稿。其成功除科研人员实力,还靠曙光存储支持。曙光为其AI集群升级,提供单节点带宽150GB/s的存储方案,且已大规模落地科研领域。

新智元
推荐文章8

一文看懂“存算一体”

文章介绍存算一体概念,它因传统冯·诺伊曼架构在数据爆炸、AI崛起下暴露“存储墙”“功耗墙”问题而提出。阐述其发展历程、技术路线、存储介质、应用场景,也指出技术、生态、市场方面挑战,前景潜力大。

芯师爷