「安全隐患」共找到 908 篇相关文章
OpenClaw爆火背后,仅8.6%用户能察觉异常!多校联合实证
OpenClaw等AI智能体爆火,其安全隐患凸显。多校联合研究发现,仅8.6%的用户能感知智能体媒介欺骗,总结了6类认知失效模式,认为体验式学习或比静态提醒更能提升用户警觉性。
天使轮数千万元融资,这家公司想成为 AI 时代用户的安全执行顾问
主打认知安全的缔零科技获数千万元天使轮融资,资金用于「缔零法则」技术迭代等。其产品以AI治理AI,降本增效。公司曾推「缔零智数」,现「缔零法则」把控模型推理。未来有ToC计划,想成用户安全助手。
代码暴减99.9%!独立开发者仅用500行代码做出安全版OpenClaw,GitHub星数狂飙
近日,独立开发者 gavrielc 制作的开源 AI 助手 NanoClaw 火了。它核心代码仅约 500 行,实现 OpenClaw 同等核心功能。相比原版 Clawdbot 代码量大减,还解决了 OpenClaw 安全架构问题,是其安全替代方案。
“掩码即武器”,四款扩散LLM全部破防 ? 上交&上海AI Lab发现dllm致命安全缺陷
上海交通大学、上海人工智能实验室等团队研究指出,扩散语言模型(dLLMs)有根本性架构安全缺陷。他们提出DIJA攻击框架,能让多个dLLMs大概率生成有害内容,还呼吁从多方面加强dLLM安全。
The Batch: 941|盲人辅助模型中的隐患
视障患者用AI评估外貌引发关注。失明记者Milagros Costabel撰文探讨用视觉语言模型作“虚拟镜子”的挑战与隐患,如AI会给出评判性反馈,心理学家担心这加剧抑郁焦虑。产品应提供客观解读。
大语言模型 + 编程智能体 = 安全噩梦
作者结合黑帽大会英伟达演讲,指出大语言模型和编程智能体扩大攻击面。如攻击者利用公共资源留恶意指令,实施水坑攻击。强大编程智能体虽普及,但易造成安全漏洞,虽有防御措施但效果有限。
谨慎用OpenClaw:上海科技大学发布其全面安全体检报告
上海科技大学联合上海人工智能实验室对爆火的智能体OpenClaw做安全审计,在34个测试场景中,整体安全通过率58.9%,暴露出多方面问题,研究据此给出纵深防御策略。
面壁智能开源 EdgeClaw,一款安全高效端云协同的龙虾 Agent。
当下AI Agent端侧常被忽视,数据任务都涌向云端致隐私泄露和算力浪费。近期面壁智能等联合开源EdgeClaw,以三级安全和性价比感知协同机制,解决OpenClaw数据泄露、token成本高等问题。
刚刚,北大&360里程碑式突破!32B安全分碾压千亿巨兽
2025年9月23日,北大 - 360联合实验室发布TinyR1 - 32B模型,仅用20k数据微调就实现安全性能突破,兼顾推理与通用能力。还推出TinyR1 - Safety - 8B,且系列模型已全面开源。
AI Agent也有体检中心了?诊断级安全框架AgentDoG正式开源
上海人工智能实验室今日开源全球首个具深度诊断能力的AI智能体安全护栏框架AgentDoG。它能精准定位风险、解释决策成因。团队提出三维风险分类法,构建数据合成管道,实验表现领先,还集成归因模块。