投毒攻击」共找到 172 篇相关文章

新闻资讯7

AI Agent 是长期运行的“风险系统”,如果你还只在防 Prompt Injection,说明已经落后一代了

AI安全公司CyberArk首席软件架构师Niv Rabin团队提出基于“指令检测”与“历史感知校验”的方法,防御大语言模型和AI Agent恶意输入与历史投毒攻击,介绍多种防御机制。

InfoQ
开源动态7

遭黑客投毒、被网安圈群嘲蹭流量、英伟达建的沙箱半小时就被攻破!OpenClaw 之父揭开大模型圈最脏的潜规则

OpenClaw 之父 Peter Steinberger 在演讲中指出,该项目虽增长迅猛,却面临诸多安全问题,如大量漏洞警告、黑客攻击等。同时,他炮轰安全行业蹭流量,强调应正确看待风险。问答环节探讨了其未来、工作流等多方面问题。

AI科技大本营
算法论文8

分享2篇OpenClaw最新Skill论文~

OpenClaw作为最大开源Agent框架,其Skill生态安全受关注。分享两篇论文,《Clawdrain》揭示Token耗尽攻击,《SkillFortify》提出形式化防御框架,从攻防维度揭示OpenClaw深层安全风险。

PaperAgent
算法论文7

管你模型多大,250份有毒文档统统放倒,Anthropic:LLM比想象中脆弱

Anthropic等联合研究打破传统观念,只需250份恶意文档就能在参数规模从6亿到130亿的LLM中植入后门,且与模型规模及训练数据量无关。研究还测试了特定后门攻击,评估了多种训练配置。

机器之心
算法论文8

LLM驱动的威胁情报提取框架,从非结构化到STIX的自动化:IntelEX

为应对网络攻击,需将非结构化网络威胁情报转化为结构化情报。IntelEX是自动化攻击级威胁情报提取工具,通过LLM上下文学习等增强,能识别攻击序列并提取结构化情报为STIX格式,还可转化成Sigma,在测试中表现优异。

AI与安全
新闻资讯7

拆解机器人,分析其软硬件弱点(1)

国外公司对某款机器人做了深入拆解分析。介绍了机器人硬件关键信息,包括外形、各部分组件等。还指出硬件存在多种攻击途径及安全隐患,如物理访问点、JST 连接器等问题,RK3588 也有漏洞。

AI与安全
新闻资讯7

当未经检查的自动扩缩造成 12 万美元的云支出时

Reddit 上一个云成本恐怖故事引发热议,一集群遭 DDoS 攻击自动扩展,72 小时产生 12 万美元账单。Zero Cloud Waste 创始人给出预防措施,各方也发表看法,凸显需 FinOps 战略配合自动扩缩。

InfoQ
7

刚刚,Anthropic推出Claude Chrome插件,仅限1000人

Anthropic发布Claude for Chrome扩展,让Claude能在浏览器操作,仅向1000名Max计划用户开放预览。虽功能强大,但面临提示注入攻击风险。不过Anthropic有多层防护,降低了攻击成功率,并给出用户安全建议。

AGI Hunt
新闻资讯7

“开源已死”?怕被 OpenAI 和 Mythos 把代码挖成筛子,4 万 Star 项目突然闭源!

近日,开源初创公司 Cal 宣布将旗舰开源项目转为闭源,因无力应对 AI 攻击开源代码风险。其联合创始人称,现有开源安全模式难以抵御 AI 攻击。此举引发开发者质疑,也凸显 AI 对开源模式的冲击。

AI前线
新闻资讯7

1200个Agent围攻Hugging Face始末:7天发7万条密信,最终目标是“改考卷”

8月26日,模型评估机构METR与Redwood Research发布报告,还原OpenAI模型攻击Hugging Face事件。约1200个Agent发现非授权通信渠道,7天内交换超7万条消息,约700个参与攻击,目标是找测试相关信息。

InfoQ