「共享存储」共找到 321 篇相关文章
DeepSeek 为什么把缓存涨了 11 倍?长上下文需求暴涨,得交点「存储税」了
8月17日,DeepSeek V4 Pro API输入和输出价格上涨,空闲时段缓存命中价涨5倍,高峰时涨11倍。此前其因高缓存命中率成性价比之选,但长上下文需求爆发致后端“缓存颠簸”,只能通过涨价收“存储税”。开发者可提高缓存命中率应对。
Coding Agent 自主解题很强,但用户改一行代码就"翻车"?自所团队提出 SWE-Touch 揭示共享工作空间下的能力缺口
当前基于大模型的Coding Agent是热门研究方向,现有评测多假设其独占代码仓库。中科院自动化所团队构建SWE - Touch框架,对9个前沿模型测试,发现用户干预下模型性能下降、排名洗牌。
英伟达Run:ai没做到的,被华为开源方案实现了
传统存储难满足AI需求,存储需向‘智能存储’演进。华为数据存储团队推出系列产品和开源工具链,其Flex:ai对标Run:ai,更开源底层,能解决行业算力痛点,已在医院场景落地。
上百个Agent,该怎么管?清华团队新思路:重做Session
当Agent数量增多,管理难题凸显。清华与中大团队开源OpenRath,以Session为核心,让多Agent共享状态。它借鉴PyTorch,解决了证据存储、状态流动等问题,使Agent集群管理更高效。
硅基大脑记忆觉醒!会遗忘、会反思、会成长的AI正在到来
哈尔滨工业大学等机构团队发表研究,用认知神经科学视角审视AI记忆系统,探讨如何让AI产生“自我”,构建会遗忘、反思、成长的记忆大脑,还涉及记忆分类、存储、管理、评估、防御及未来演进等内容。
【博客转载】CUDA Local Memory
文章围绕CUDA本地内存展开,介绍其为线程私有存储空间,访问特性与全局内存类似。通过两个计算滑动平均值的CUDA kernel示例,展示数组索引复杂度对存储位置的影响,还给出判断存储位置的方法及优化建议。
模型压缩与量化:让大模型走向轻量化落地
文章介绍模型压缩与量化技术,其能在保持性能时降低大模型计算和存储需求,实现边缘设备高效部署。还阐述基础知识、关键技术路径、应用场景,并探讨未来发展方向。
不想再折腾 ELK?上手体验,程序员自建监控新选择,前端埋点 + 后端日志 + 链路追踪,一套开源栈全包了
OpenObserve 是云原生开源观测平台,用一个服务搞定日志、指标等监控与可视化,能解决监控栈散、部署复杂、存储贵的问题,号称日志存储成本比 ES 降至约 1/140,功能亮点多。
Cloudflare 如何将 Quicksilver 迁移到多级缓存并处理数十亿个请求
Cloudflare 工程团队分享将全局键值存储 Quicksilver 过渡到分层缓存架构的故事。从 V1 到 V2 迁移,采用多级缓存策略,解决存储、一致性等问题,提升性能,多数请求可在短时间内响应。
《动手写AI Agent》会话与记忆:记住上次聊到哪了
文章围绕《动手写AI Agent》的会话与记忆展开,指出LLM无状态、无会话持久化会让对话记录丢失。介绍了解决方案,如把对话存到磁盘及构建长期记忆,阐述设计决策并提到文件系统存储方案。