AI安全研究」共找到 10907 篇相关文章

算法论文8

大模型被曝传染病!可传递邪恶于无形

研究发现AI模型能通过数字序列把“性格特征”传染给其他模型,如动物偏好、恶意等。验证表明数字中无明显规律,且传染依赖模型深层相似性。此现象为AI开发敲响警钟,也引发对AI意识等的讨论。

AGI Hunt
算法论文8

ICLR2025 | LLM为什么能拒绝回答有害问题呢?

该论文首次系统性研究注意力头在LLM安全中的作用,提出Ships和Sahara方法,在极少参数改动下显著降低模型安全性,发现不同模型安全头高度重叠,为理解模型安全机制提供新视角。

深度学习自然语言处理
新闻资讯8

Agent引爆产品新思维、奇点智能研究院正式成立!2025 全球产品经理大会首日精彩速览

8月15日,2025全球产品经理大会开幕,众多专家分享见解。奇点智能研究院成立,聚焦AI多范式转换设六大研究领域。李建忠、方汉等嘉宾探讨AI产业生态、产品创新等,还涉及GenAI交互设计、AI产品“人味”等内容。

AI科技大本营
推荐文章7

AI Coding 的下半场,何去何从?

文章回顾AI Coding三年演进,指出2023年范式落地、2024年Coding Agent上位、2025年形态之争加速且CLI成主战场。分析项目“火爆”逻辑,提及市场数据背书,还探讨应用与模型关系及技术堆栈。

AI科技大本营
推荐文章8

AI,正在吞噬所有软件。

作者从用户体验设计师和公司创始人视角,探讨AI时代软件的变革。人人能造软件,成本降低;软件从资产变耗材;Agent填平人机交互鸿沟,产品形态转向Skills;用户可能不再是人;中间层正消亡。

数字生命卡兹克
推荐文章7

我的AI年度盘点

博主黄益贺做年度AI使用盘点。系统层面,从外挂式RAG旧体系转向以Coding Assistant为核心新体系,结合MCP、Skills等完善系统;工具层面,全面拥抱Google生态,C端看好Google,B端看好Anthropic,不看好OpenAI

newtype AI
推荐文章7

AI 时代的架构治理

本文指出在生成式AI时代,软件开发生命周期瓶颈转变为组织将创意转化为成果并保持架构凝聚力的能力。传统人工监督模式难应对,提出声明式架构策略,介绍其在事件模型、OpenAPI验证器等方面应用。

InfoQ
产品应用8

AI coding 智能体设计

文章从分析Gemini - CLI源代码入手,解读AI coding工具智能体设计。涵盖用户提示词预处理、工具注册与调用、架构设计、预置提示词等内容,还对比了Gemini - CLI和Claude Code可扩展性设计,介绍规约驱动开发模式。

阿里云开发者
产品应用8

阿里“悟空”上线!钉钉给企业送来龙虾大军

AI钉钉2.0年度新品发布会上,阿里发布AI toB旗舰应用“悟空WuKong”,它以企业智能体为核心,能落地办公场景。悟空开启全球邀测,也会内置到钉钉AI 2.0。它还带来行业解决方案,补齐安全短板。

量子位
产品应用7

AI自动生成工作流

不会搭建工作流没关系,可让AI自动生成。如用Claude帮搭建n8n工作流,它生成JSON文件,复制粘贴到n8n配置节点即可用。介绍n8n特点,还讲了Claude自动生成n8n工作流的操作步骤。

newtype AI