算法论文8
自进化CAITLYN防御AI Agent投毒
新智元
AI 摘要
研究人员针对AI Agent面临的隐蔽prompt注入投毒攻击,提出自进化防御中间件CAITLYN,分层检测平衡成本与效果,可从漏网攻击合成新防御技能,新攻击场景下攻击成功率降约40个百分点。
阅读原文 · 新智元
网页藏毒,劫持Agent?你需要会「追凶」的自进化女警系统
AI Agent接入外部环境后,易遭遇隐蔽的网页藏毒、prompt注入攻击,传统防御要么成本过高要么易被新型攻击绕过,本文介绍新提出的自进化防御系统CAITLYN,验证了其防御效果。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
新闻资讯8
元空端侧AI拿下惠普电脑预装
北大出身的创业团队元空智能,提出大模型静态互联网数据红利见顶,端侧是下一轮能力跃迁核心,重新定义端侧AI为「模型×Agent×设备」,发布Boxer端侧模型与两款Agent产品,其端侧AI已拿下惠普商务电脑预装,实现规模化落地。
量子位
推荐文章8
上交清华字节等发布AI递归自进化路线图
本文解读了上海交大、清华、字节跳动等机构联合发布的递归自我改进AI综述,提出五级AI自主改进框架,分析RSI发展现状、应用场景与核心挑战,指出RSI有望突破AI研发的人力成本瓶颈。
AI寒武纪
算法论文9
深大港科大提出ECA防Agent操作幻觉
本文针对Agent场景下AI幻觉会转化为实际错误操作的问题,介绍深圳大学与香港科技大学提出的ECA框架,通过独立验证加门控检查降低不安全执行风险,给出测试数据验证方案有效性。
机器之心
新闻资讯8
一张图看懂大厂RSI研发进度
本文报道中国前沿AI机构Theseus Labs联合多家产学研机构发布RSI领域研究报告,梳理全球72家头部AI厂商的RSI研发进展,提出五级RSI框架与HCI指标,拆解出可工程化的RSI发展路径,发布后在海外AI圈引发热议。
机器之心