「页面缓存漏洞」共找到 325 篇相关文章
英伟达GPU被曝严重漏洞,致模型准确率暴跌99.9%
英伟达GPU被白帽黑客发现严重漏洞,通过GPUHammer攻击可使大模型准确率从80%降至0.02%。此攻击属Rowhammer类,直接对显存“物理动手”。英伟达建议的防御措施会使模型性能下降。
Meta最新REFRAG框架引爆RAG圈!KV缓存暴降90%,速度狂飙30×
Meta推出REFRAG框架解决RAG难题。它能在不修改解码器参数下压缩上下文、复用文档向量等。实验显示,它降低KV缓存、加速TTFT,在多任务表现佳,为大模型与知识库结合提供新范式。
深度拆解 Hermes Agent 的记忆系统:它如何修正 OpenClaw 的误区
文章深度拆解 Hermes Agent 记忆系统,介绍其四层记忆系统,包括提示词记忆、SQLite 历史会话存档、智能体技能管理和用户建模。与 OpenClaw 对比,Hermes 更关注缓存效率,遵循冷热分离、缓存优先等原则。
超棒!打造顶级智能体Claude Code的经验教训
Claude Code工程师Thariq文章受开发者盛赞,揭示打造智能体经验。提示词缓存是关键,要合理排列顺序;管理动态上下文需避免破坏缓存;为智能体选适配工具,随模型进化调整行动边界。
Claude Fable 5.1 发布:缓存读降价 75%,但实际更贵了
Anthropic 发布 Claude Fable 5.1 和 Mythos 5.1。Fable 5.1 性能全面上涨,但出现价格悖论,缓存读降价 75% 实际更贵。在 Agent 类任务与 Opus 5 基本持平,推出 EFS 应对数据留存争议,还有多项科研演示。
Claude Code 省 Token 指南:慎用 1M 上下文,不开新会话或者总是开新会话都不对
文章聚焦Claude Code省Token问题,分析配额消耗快的原因,介绍提示缓存机制,给出省钱策略、操作规则,还提及委派工作及澄清误解,强调让缓存多命中、上下文少装无关内容。
Anthropic神话模型发布,但不让你用
Anthropic发布神话模型Claude Mythos Preview却不开放使用,发起玻璃翼计划联合科技巨头用该模型修复全球软件漏洞。此模型能自主发现众多零日漏洞,合作伙伴应用后强调跨行业协作应对网络安全挑战。
OpenAI 又发布了一个新的AI Agent~
OpenAI发布新AI Agent Aardvark用于找代码漏洞,流程包括监控Git提交等,测试能发现92%已知漏洞。还公布AI浏览器Altas技术架构,采用进程隔离和IPC通信,启动快,但维护成本高。
OpenAI首个GPT-5找Bug智能体:全自动读代码找漏洞写修复
OpenAI发布由GPT - 5驱动的白帽Agent——Aardvark,能在大规模代码库自动发现并修复安全漏洞。它不依赖传统技术,工作流程清晰,已开启内测。10月多家科技巨头也布局Agentic AI + 代码安全。
LLM加速利器LMCache,极大降低GPU资源消耗
LMCache是大语言模型服务引擎扩展组件,能降低首次响应延迟、提升吞吐量,适用于长上下文场景。它将KV缓存存于多级存储,跨服务实例复用任意重复文本的KV缓存,节省GPU算力,与vLLM结合优化显著。