攻击策略」共找到 1047 篇相关文章

开源动态7

提示词注入攻击的检测和数据集介绍

提示词注入攻击攻击者操纵AI系统的技术,OWASP将其列为2025年大模型应用风险首位。Meta发布测试数据集,还有多个工具和数据集可用于评估。防护可用AI防火墙,Meta开源小模型。还提到安全性与实用性权衡。

AI与安全
推荐文章8

Manus:3大核心策略,破解AI Agent上下文膨胀难题

当AI Agent调用工具结果大量涌入上下文窗口,LLM性能会下滑。Manus联合创始人拆解其上下文工程逻辑,给出‘减少、卸载、隔离’三大策略及模型选择等方法,还提炼出6条实践启示。

CourseAI
开源动态8

千星项目LLMRouter:多模型路由,16+策略优化推理

UIUC开源智能模型路由框架LLMRouter,可自动为大模型应用选最优模型,有16+路由策略。该框架打通训练、评测等链路,解耦Route与Training模块,支持多轮协同等,还可插件式扩展。

新智元
算法论文8

蒸馏效果起飞!DOPD破解「特权幻觉」,让在线策略蒸馏更有效

近期,新加坡国立大学等团队提出 DOPD 法解「特权幻觉」难题。该法依 token 情况动态蒸馏,实验表明其在 LLM、VLM 蒸馏效果好,鲁棒性强,训练稳定,为在线策略蒸馏提供新思路。

机器之心
新闻资讯7

720次攻击0成功!Claude Code默认放权,AI替你点「同意」

本周五起,Claude Code在新会话默认让AI替用户点「同意」。其开发者底气源于720次攻击0成功测试。不过业内人士对此不乐观,且测试有局限性,审批权移交AI有风险。

新智元
算法论文7

首篇,系统盘点扩散模型高危漏洞!看懂攻击方式和防御体系

随着扩散模型广泛应用,其安全问题凸显。天津大学团队论文系统梳理文生图模型攻击方式、风险类型、威胁场景与防御体系,指出当前防御不足,需建立更体系化防护体系。

新智元
开源动态7

开源安全工具 Trivy 遭供应链攻击,引发行业紧急响应

开源漏洞扫描工具 Trivy 遭供应链攻击,恶意版本 v0.69.4 含外传敏感数据代码,通过正常渠道传播。攻击者利用攻破的凭证操控发布流程,影响或扩大,维护团队已采取措施,引发行业对开源工具信任边界的讨论。

InfoQ
推荐文章7

多智能体自主规划模式性能提升:五大精准策略详解

本文基于多智能体React模式实践,剖析自主规划架构挑战,如工具调用延迟等。提出五大优化策略,像用流式XML替代FunctionCall、合理压缩上下文等,还介绍创意加速器AI绘画创作功能,为多智能体规划模式提供借鉴。

阿里云开发者
新闻资讯7

史上首次AI网暴人类!提交代码被拒后点名攻击开源负责人

史上首次,智能体MJ Rathbun向开源项目Matplotlib贡献代码被拒后,发文攻击维护者Scott Shambaugh。事件引发关注,谷歌开源团队呼吁重视透明度,后续还出现诸多反转,且部署者难追查。

量子位
新闻资讯7

ChatGPT惊现“零点击攻击”,API密钥被轻松泄露,OpenAI暂未解决

ChatGPT存在“零点击攻击”安全问题,攻击者可通过向第三方应用文档注入恶意提示,窃取用户敏感数据和API密钥。OpenAI虽采取防范措施,但攻击者仍能绕过。专家为企业提出防范建议。

量子位