「隐私攻击」共找到 334 篇相关文章
NTU等联合提出A-MemGuard:为AI记忆上锁,投毒攻击成功率暴降95%
在AI智能体依赖记忆系统的当下,记忆投毒攻击兴起。A-MemGuard作为首个为LLM Agent记忆模块设计的防御框架,通过共识验证和双重记忆结构,解决防御难题,使投毒攻击成功率暴降超95%。
00后黑客落网!曾运营大型僵尸网络,频繁攻击腾讯游戏、DeepSeek、X平台
活跃多年的高危DDoS僵尸网络‘RapperBot’被取缔,主谋22岁美国男子Ethan Faulds被捕。该网络曾攻击腾讯游戏、DeepSeek、X平台等。文中介绍其家族情况、盈利模式,还提及腾讯宙斯盾系统及防护建议。
AI安全上,开源仍胜闭源,Meta、UCB防御LLM提示词注入攻击
Meta和UCB开源安全大语言模型Meta - SecAlign - 70B,其对提示词注入攻击鲁棒性超闭源方案,还具更好的agentic ability。介绍了提示词注入攻击背景、防御方法,该模型打破闭源垄断,开源代码助力安全AI建设。
LLM越狱攻击的威胁被系统性高估? 基于分解式评分的「越狱评估新范式」出炉
目前LLM越狱攻击评估常依赖间接指标或LLM宏观判断,易有偏差。德国、中国等研究团队提出JADES框架,用分解式评分机制,揭示过去高估越狱攻击威胁,为评估建新标准。
你和ChatGPT的私密对话正在全网裸奔!网友炸锅:我把ChatGPT当知己,它却把我隐私挂网上
《Fast Company》曝光谷歌搜索现 ChatGPT 用户私人对话,虽部分无个人信息,但仍涉及大量深层隐私。OpenAI 称是“短期实验”,将移除相关功能并删索引内容,不过清理未完成,网友对此质疑声不断。
The Batch:833 | 针对智能体的钓鱼攻击
研究人员发现误导基于大语言模型的自主智能体的方法,即通过在热门网站植入恶意链接,利用智能体对热门网站的‘隐性信任’攻击。测试显示智能体易受诱导执行有害行为。
提示词注入攻击的检测和数据集介绍
提示词注入攻击是攻击者操纵AI系统的技术,OWASP将其列为2025年大模型应用风险首位。Meta发布测试数据集,还有多个工具和数据集可用于评估。防护可用AI防火墙,Meta开源小模型。还提到安全性与实用性权衡。
隐私堡垒!Presenton开源革命:本地AI生成PPT,敏感数据永不触网!
本周GitHub新开源项目Presenton可离线制作PPT,支持主流AI模型,本地运行保护数据隐私,有灵活自定义模板和API集成功能,还具备多模型支持、主题定制等特性。
720次攻击0成功!Claude Code默认放权,AI替你点「同意」
本周五起,Claude Code在新会话默认让AI替用户点「同意」。其开发者底气源于720次攻击0成功测试。不过业内人士对此不乐观,且测试有局限性,审批权移交AI有风险。
告别天价API账单!开源Chatterbox语音服务器上线,隐私与效率双赢!
第三方语音合成API成本高、有隐私风险,直接部署开源模型配置复杂。开源的Chatterbox-TTS-Server基于Chatterbox TTS模型,有Web界面、声音克隆等功能,支持GPU和Docker,可解决部署难题。