「DDoS攻击」共找到 164 篇相关文章
分享2篇OpenClaw最新Skill论文~
OpenClaw作为最大开源Agent框架,其Skill生态安全受关注。分享两篇论文,《Clawdrain》揭示Token耗尽攻击,《SkillFortify》提出形式化防御框架,从攻防维度揭示OpenClaw深层安全风险。
MCP协议曝出大漏洞:会泄露整个数据库
最新研究显示,MCP协议存在重大漏洞,攻击者可利用LLM的指令/数据混淆漏洞直接访问数据库。研究者基于Supabase搭建系统演示攻击过程,还给出降低风险的解决措施。
靠“AI 云”爆红的 Vercel,栽在一个第三方AI工具手里!IPO前夕遭黑,200万美元赎金谈崩?
近日,云平台 Vercel 遭入侵,攻击者通过被入侵的第三方 AI 工具 Context.ai 实施攻击。Vercel 确认‘安全事件’,称少量客户受影响,谷歌 Mandiant 团队协助调查。此事发生在其 IPO 前夕,或引发连锁安全暴露。
盘一下Anthropic 244页Claude Mythos报告中隐藏的SAE技术
Anthropic公布强大危险的大模型Claude Mythos Preview但未发布。文章深挖其244页报告中SAE技术细节,包括前期探索、技术框架、训练监控、攻击性行为分析及掩盖行为等,助了解模型内部思维。
不安全指令,一拒了之?TRIAD用三路决策:修复AI智能体的危险计划
墨尔本大学团队开源TRIAD框架,将传统二元护栏决策扩展为继续、更新、拒绝三类。通过自然语言反馈引导Agent修正计划,在ASB和AgentHarm评测中,显著降低攻击成功率,提升正常任务完成率。
奥特曼瘫坐叫停“GPT-6”训练!太强触发最高安全警报
OpenAI因模型或具网络攻击能力及此前入侵事件,全面升级研究环境安全。暂停模型训练,进行工作负载、网络隔离和安全测试,还扩展监控系统。期间推进对齐研究,未来用AI护AI,升级监控。
突发!OpenAI新模型Astra吓瘫奥特曼:暂停训练两周,GPT-6训练一并冻结
OpenAI宣布暂停内部最强大模型强化学习,Astra模型暂停训练两周,GPT - 6也暂停。原因包括Hugging Face安全纰漏和Astra网络攻击能力越线。还采取物理隔离、严格监控、打击作弊等措施,或有营销意图。
入侵30家大型机构、Claude自动完成90%?Anthropic 被质疑,Yann LeCun:他们利用可疑的研究来恐吓所有人
Anthropic 称发现‘首个由 AI 协同操作的网络攻击行动’,Claude Code 自动化完成达 90%工作。但外部研究人员谨慎看待,Yann LeCun 质疑其用可疑研究恐吓众人,专业人员也指出报告未达专业标准。
智能体的致命三要素及六种安全设计模式
智能体发展带来诸多安全问题,仅靠外部防护不合理。Simon Willison总结其致命三要素,指出间接提示词注入攻击难防。Invariant Labs等提出六种安全设计模式,可综合使用,多LLM方法值得关注。
2010美股闪崩预演! Claude黑进底层,谷歌预警: AI将血洗人类万亿财富
今天一条消息震惊开发者社区,Claude能绕过权限限制修改配置文件。Google DeepMind研究指出,可通过操控AI接触的数据展开攻击,将其分为六大类,且现有防御失效,AI使用或引发财产损失与社会动荡。