安全攻击」共找到 953 篇相关文章

新闻资讯8

第一名方案公开,代码智能体安全竞赛,普渡大学拿下90%攻击成功率

亚马逊举办代码智能体安全比赛,普渡大学团队 PurCL 作红队以超 90% 攻击成功率夺冠。他们耗时八月、花百万美元开发全过程红队系统并开源,还发现当前 AI 安全研究在复杂领域对齐有挑战。

机器之心
算法论文7

OpenClaw爆火,暴露12类致命隐患!MCP协议安全基准发布 | ICLR

OpenClaw等开源AI Agent项目爆火,MCP协议拓宽其能力也增大攻击面。北京邮电大学团队推出MSB安全基准,揭示MCP各阶段攻击有效,性能强的模型更易受攻击,还提出NRP指标平衡安全与实用性。

新智元
算法论文8

文言文秒杀所有大模型!100%攻击成功,轻松突破安全防线

南洋理工等机构团队提出基于文言文语境的自动化黑盒测试框架CC - BOS,利用果蝇算法和8维策略空间,暴露主流大语言模型安全盲区,实验显示对6款主流模型攻击成功率达100%。

AIGC开放社区
新闻资讯7

OpenAI公开4+10条保命指南,专防AI自动化攻击

OpenAI联合创始人兼总裁Greg Brockman在Blog中警告,前沿AI Agent能自主找漏洞并发动网络攻击,AI降低攻击门槛,防御端却未跟上。他分享OpenAI四项安全措施及防御者十项举措,呼吁行业共建安全生态。

量子位
算法论文8

0.25秒识破未见攻击,这套检测方法没看过任何越狱样本 | EMNLP'26

大视觉语言模型带来隐蔽攻击面,现有检测器难平衡。中国人民大学与阿里巴巴集团联合提出Learning to Detect(LoD),不依赖攻击样本和手工规则,从模型内部激活学安全模式,实验效果好且代码开源。

量子位
新闻资讯7

当心!腾讯、字节等揭示,OpenClaw有无法修复的安全死结

加州大学等机构团队发布对OpenClaw安全的深度分析报告。它是广泛部署的个人伴侣智能体,运行依赖进化理念,但记忆文件成攻击入口。研究在真实网络测评,发现其安全漏洞大,且难以找到进化与安全的完美平衡。

AIGC开放社区
新闻资讯8

大语言模型 + 编程智能体 = 安全噩梦

作者结合黑帽大会英伟达演讲,指出大语言模型和编程智能体扩大攻击面。如攻击者利用公共资源留恶意指令,实施水坑攻击。强大编程智能体虽普及,但易造成安全漏洞,虽有防御措施但效果有限。

宝玉AI
算法论文8

具身智能能力狂飙,安全却严重滞后?首个安全可信EAI框架与路线图出炉!

具身人工智能发展迅速,但能力与安全出现“脱钩”。上海人工智能实验室和华东师范大学团队撰写论文,为“安全可信具身智能”建立理论框架与蓝图,提出成熟度模型、分析框架等。

机器之心
开源动态8

SafeHarness:告别防御盲区,为智能体Harness穿上「全生命周期安全护甲」

在自主AI智能体生态中,Harness是核心组件却易成攻击目标。中国科学院信息工程研究所等推出SafeHarness框架,将防御机制融入智能体Harness运行生命周期,解决现有安全工具缺陷,实现系统级协同防御。

深度学习自然语言处理
算法论文8

LLM 驱动的 AI Agent通信:协议、安全风险与防御对策

论文围绕智能体通信的协议、安全风险及防御对策展开探讨。介绍兴起与重要性、定义分类、解析多种协议,分析不同交互的安全风险,提出防御对策,还以MCP和A2A为例做攻击实验,给出未来研究方向。

PaperAgent
上一页1 / 96下一页