Prompt漏洞」共找到 352 篇相关文章

推荐文章7

忘掉《Her》吧,《记忆碎片》才是 LLM Agent 的必修课

文章把电影《记忆碎片》主角莱纳德看作真人版 Agent,结合情节拆解 Agent 上下文工程知识。阐述 Agent 取代 Chatbot 成行业主流,借莱纳德记忆系统说明上下文工程支柱,还指出 Agent 设计漏洞及需反思模块。

Founder Park
新闻资讯8

刚刚,Anthropic官方Cluade 5使用指南发布

Anthropic发布Claude 5的Context Engineering官方指南,指出为Claude Opus 5和Claude Fable 5删掉Claude Code超80%的system prompt,在编码评估上无明显损失。还揭示6组范式反转及四类上下文载体新分工。

PaperAgent
8

现实版“盗梦空间”?欧洲极客论文全网爆火,一战戳破三大巨头安全神话,35万机密在公网裸奔

欧洲两位安全研究员的论文《从专有 LLM API 中窃取推理轨迹》爆火。他们揭示 OpenAI、Anthropic 和 Google 用的“无状态架构”有漏洞,能利用小模型解码大模型推理轨迹,导致隐私泄露等风险。

AI科技大本营
开源动态7

Agent能自己“复盘”和“进化”,这个开源框架牛了!

文章介绍了自进化AI,其核心是执行、评估、进化的反馈循环,能自动修改Prompt和工作流。还讲解了SEW、TextGrad等优化器原理,并以SEW为例展示逻辑,最后推荐开源框架EvoAgentX。

探索AGI
产品应用7

人类遗忘的难题解法,被GPT-5重新找出来了

GPT-5 Pro从埃尔德什问题定位到关键文献,发现该“未解决”数学难题早在2003年已被解决。此前网友曾热烈讨论此问题,此外,有教授称GPT-5 Pro能快速发现论文漏洞

量子位
算法论文8

无需训练,如何提升黑箱VLM?CARPRT用「类别感知」给出答案

近年来,视觉 - 语言模型(VLMs)改变图像理解范式,但零样本分类性能对 Prompt 敏感。墨尔本大学 TMLR 小组提出 CARPRT 方案,以“无训练、黑箱适配、类别专属权重”解决提示词语义适配不足问题,已被 ICLR 2026 接收。

机器之心
产品应用7

从输入指令到代码落地:Cline AI 源码浅析

文章从源码角度剖析 Cline AI 将自然语言指令转化为编程任务的过程,包括启动调试、前端输入、主进程处理、任务初始化、构建提示、模型请求等环节,指出核心是 prompt 组装和 tools 调用。

阿里云开发者
推荐文章7

什么时候不该微调:比“怎么微调”更重要的一件事

文章指出微调失败常因一开始就不该调。强调微调解决行为问题而非能力问题,还列举了不该微调的五种场景,如知识接入问题、Prompt没写好等,建议先验证思路,明确目标再行动。

机器学习AI算法工程
算法论文7

AI越会思考,越容易被骗?「思维链劫持」攻击成功率超过90%

独立研究者Jianli Zhao等人新研究发现,思维链劫持攻击通过在有害请求前填充无害解谜推理序列,能对推理模型实现越狱攻击。在HarmBench基准上,对多模型攻击成功率超90%,揭示思维链推理存在新安全漏洞

机器之心
开源动态7

警惕!“养龙虾”风险,一键给你的Openclaw做安全体检

OpenClaw在短时间内登顶GitHub开源榜首,国内企业纷纷部署。但它存在安全隐患,如漏洞、隐私风险等。朱雀实验室联合腾讯云EdgeOne推出「OpenClaw安全体检」功能,可自动完成全面体检与风险评估。

腾讯技术工程