「提示注入诱导攻击」共找到 567 篇相关文章
首个接入GPT-5的视频Agent!一句话生成商业级广告大片,分镜配音字幕等全包了
AI视频生成进入Agent时代,Video Ocean是首个接入GPT - 5的视频Agent,输入提示词就能自动完成分镜、画面等生成爆款视频。它有自动化创作生态系统,操作简单,新手也能上手。
Anthropic 发布最新研究:LLM 展现初步自省迹象
Anthropic 最新研究表明,Claude 展现出真实但有限的内省能力,能在某种程度上识别自己内部状态。研究团队开发验证方法,通过概念注入等实验进行测试,还发现认知控制证据等,不过该能力有局限。
ICML 2025 Spotlight | 用傅里叶分解探讨图像对抗扰动,代码已开源
文章聚焦图像对抗净化,现有基于扩散模型策略在时域难解耦干净像素与扰动,损害图像语义。作者从频域研究,用傅里叶分解,发现扰动倾向破坏高频谱,提出注入低频信息,效果显著,论文与代码已开源。
彻底封杀!Anthropic第四刀砍向龙虾,开发者哀嚎,两大创始人互喷!
前天Anthropic封杀OpenClaw订阅额度后,24小时内又在官方轻量化命令行工具查人,提示词含“OpenClaw”就返回400错误。两大负责人隔空交火,开发者各寻出路,这或成Anthropic战略失误。
无需训练,即插即用:西湖大学发布世界模型WorldForge,让普通视频模型秒变「世界引擎」
自Sora亮相,AI视频可控性成瓶颈。西湖大学AGI实验室团队提出WorldForge框架,在推理时为视频模型注入「时空几何」,无需训练,实现单图360°环绕视频生成和视频重运镜等,降低创作门槛。
半价干翻Fable 5?Opus 5实测炸场,网友:差点从椅子上摔下来
Anthropic新模型Opus 5登场,多项评测中追平或反超Fable 5,价格仅为一半。网友实测表现出色,还具备硬核自检流程,性价比高。另外,Claude Code提示词删减八成,成绩未降。
Deepseek是被降智了吗?
作者认为Deepseek被降智,存在诸多问题,如不懂用户意图、长文理解差、措辞怪异、提示词调教难、无脑捧杀、幻觉率高、深度思考弱等,还对比了与GPT在人际交往话题回复上的差异。
“由 AI 生成的代码,从诞生那一刻起就是「遗留代码」!”
如今生成式AI融入软件开发,AI生成的代码一诞生或被视为“遗留代码”。它缺乏上下文记忆和维护连续性,虽有开发者尝试弥补,但代码未来或多靠提示生成。文章观点在Hacker News引发讨论。
ICIG 2025:共话图像发展新坐标
2025年10月31日至11月2日,第十三届国际图象图形学学术会议(ICIG 2025)在徐州举行,700余人参会。大会展示前沿成果,设多场论坛与赛事,专家认为其为领域发展注入新动力,巩固中国学术交流地位。
启发学习:让大模型认知从外化到内生
当下大模型能力多靠人为框架,能力上限受限。文章提出“启发学习”,将其集成到推理侧成Isaac框架,通过Prompt与网络层注入复用旧经验,实验显示能大幅提升大模型任务性能。