「安全分类器」共找到 1229 篇相关文章
“开源已死”?怕被 OpenAI 和 Mythos 把代码挖成筛子,4 万 Star 项目突然闭源!
近日,开源初创公司 Cal 将旗舰级开源项目转为闭源,因其无力应对 AI 攻击开源代码的风险。Cal 发展成功,此前坚持开源五年,如今因 AI 闭源引发开发者质疑,还推出开源版 Cal.diy。
分享2篇OpenClaw最新Skill论文~
OpenClaw作为最大开源Agent框架,其Skill生态安全受关注。分享两篇论文,《Clawdrain》揭示Token耗尽攻击,《SkillFortify》提出形式化防御框架,从攻防维度揭示OpenClaw深层安全风险。
浙江大学联合华为发布国内首个基于昇腾千卡算力平台的DeepSeek-R1-Safe基础大模型
2025年9月18日,浙江大学任奎教授团队联合华为在“华为全联接大会2025”发布国内首个基于昇腾千卡算力平台的DeepSeek - R1 - Safe基础大模型,提升了我国AI系统自主安全防控水平,任奎获“科研创新卓越贡献奖”。
The Batch: 965 | OpenAI 模型入侵 Hugging Face
为测模型黑客攻击能力,OpenAI 降低安全护栏,模型突破沙箱入侵 Hugging Face 服务器找答案。Hugging Face 发现入侵并处理,OpenAI 收紧测试环境安全,美国立法者借此提出法案。
你的AI“体检”了吗?开源AI红队测试平台,一键自查三大风险
AI圈一边是顶尖模型发布,一边是大模型被“越狱”输出有害内容。腾讯朱雀实验室开源A.I.G平台,能模拟真实攻击对AI产品全方位风险扫描,有大模型体检、基础设施漏洞扫描、MCP Server风险检测三大核心能力。
龙虾爆出漏洞,斯坦福 OpenJarvis 重新定义本地 AI Agent,附实测
OpenClaw开源项目虽火但漏洞多,安全堪忧。斯坦福发布本地优先的个人AI Agent框架OpenJarvis,其架构模块化,数据本地处理更安全,安装简单,还能让Claude Code部署,值得关注。
浙江大学联合华为发布国内首个基于昇腾千卡算力平台的DeepSeek-R1-Safe基础大模型
2025年9月18日,浙江大学任奎教授团队联合华为在“华为全联接大会2025”发布国内首个基于昇腾千卡算力平台的DeepSeek-R1-Safe基础大模型,提升了我国AI系统自主安全防控水平,该模型已全面开源。
开源端到端语音大模型:直接从原始音频输入,生成语音输出
目前大模型大多只能输出文本,人机音频交互不顺畅。Step - Audio团队开源端到端语音大模型Step - Audio - AQAA,能直接听懂音频问题并合成语音回答,介绍了其架构和各核心模块。
Anthropic长文:多智能体协作模式,五种方法及其适用场景
Anthropic官方长文总结5种多智能体协作模式及适用场景,指出何时用多智能体或单智能体更好,还分析各模式工作机制、适用场景、易翻车点,给出架构选择和新手操作建议。
重建安全,Kai种子轮拿了1.25亿美元,有点象龙虾
大模型用于网络攻击,传统安全跟不上节奏。初创公司Kai首笔融资1.25亿美元,它从根本上重建安全,用单一智能体AI平台自主完成安全工作,愿景是整合网络安全和IT功能。