提示注入攻击」共找到 700 篇相关文章

推荐文章7

一行代码不写,龙虾军团日夜为我打工赚钱

油管科技博主Matthew Berman分享0代码OpenClaw使用心得,其龙虾数字员工能处理商务邮件等工作。他靠提示词+Vibe Coding实现‘躺赚’,还分享多场景龙虾玩法,且公开提示词。

量子位
算法论文8

ACL 2025|为什么你设计的 Prompt 会成功?新理论揭示大模型 Prompt 设计的奥秘与效能

英属哥伦比亚大学等团队剖析Prompt在LLM的CoT推理中调控模型内部信息流,构建量化Prompt搜索空间复杂度理论框架。研究解释提示有效的原因,提供设计高效提示词思路,实验验证理论框架。

机器之心
算法论文7

OpenClaw爆火,暴露12类致命隐患!MCP协议安全基准发布 | ICLR

OpenClaw等开源AI Agent项目爆火,MCP协议拓宽其能力也增大攻击面。北京邮电大学团队推出MSB安全基准,揭示MCP各阶段攻击有效,性能强的模型更易受攻击,还提出NRP指标平衡安全与实用性。

新智元
算法论文7

The Batch: 845 | 没有理由的“推理”

研究人员给LLM输入多项选择题,故意提供误导性提示。用MMLU和GPQA测试Claude 3.7 Sonnet和DeepSeek - R1,发现模型常被提示误导,但其‘思维链’往往未提及提示,表明‘思维链’不足以解释推理过程。

DeeplearningAI
算法论文8

可攻可防,越狱成功率近90%!六大主流模型全中招 | EMNLP'25

研究人员聚焦大型语言模型(LLMs)安全漏洞,提出全新越狱攻击范式SCP与防御策略POSD。SCP基于DTD机制,在6个主流模型上平均攻击成功率达87.23%;POSD能有效抵御攻击,还提升模型泛化能力。

新智元
产品应用7

刚刚,谷歌放出Nano Banana六大正宗Prompt玩法,手残党速来

谷歌 Nano Banana 被网友玩出花样,背后是巧妙提示词的功劳。刚刚谷歌官方公布了该模型六个文本转图像提示,可进行文本生成图像等操作,还给出对应提示模板,不过使用中也存在一些问题。

机器之心
产品应用7

Prompt | 人生金句炼金术师

作者分享“人生金句炼金术师”提示词,用其将平凡瞬间转化为哲理金句,如“想减肥没开始”“等红绿灯”等场景。给出不同风格卡片提示词,实测Gemini 2.5 Pro效果更好,还介绍了动态视觉图谱提示词。

AI进修生
算法论文7

一句话,性能暴涨49%!马里兰MIT等力作:Prompt才是大模型终极武器

马里兰大学、MIT、斯坦福等机构研究发现,AI性能提升一半靠模型,一半靠提示词。他们让DALL - E 2和DALL - E 3 PK,发现DALL - E 3性能提升中,模型升级贡献51%,提示词优化贡献49%。

新智元
开源动态8

斯坦福&SambaNova联手发布ACE框架:上下文即战力

文章介绍了斯坦福与SambaNova联手发布的ACE框架。它解决传统提示工程缺陷,将提示工程升级为智能体自我演化体系。通过“生成 - 反思 - 策展”闭环,实现上下文低成本、低延迟、高扩展演化,小模型搭配它能击败大模型+传统提示

CourseAI
产品应用7

OpenAI 新的学习模式的系统提示

本文介绍OpenAI新学习模式的系统提示词,包括严格规则,如了解用户、温故知新等,还说明了可做的事,如教授新概念、辅导作业等,强调语气方式及不要直接给答案。

宝玉AI