「安全测评」共找到 1019 篇相关文章
AISPM与AI防火墙--是产品不同,还是名字不同?
文章探讨AISPM与AI防火墙是产品不同还是名字不同。介绍xSPM概念及AISPM定义,分析国内AI防火墙应对威胁能力,指出AISPM更强调过程管理,未来AISPM对维护AI安全至关重要。
Anthropic万名工程师都离不开!深夜随手撸出的开源神器,被OpenAl高价收购,23人创业逆袭
昨日,OpenAI 宣布收购 AI 安全初创公司 Promptfoo,其技术将整合进 OpenAI Frontier 平台。该公司由 23 人创立,开发开源工具测试 AI 系统安全。收购后 Promptfoo 保持开源,OpenAI 将新增相关功能。
突发!OpenAI新模型Astra吓瘫奥特曼:暂停训练两周,GPT-6训练一并冻结
OpenAI宣布暂停内部最强大模型强化学习,Astra模型暂停训练两周,GPT - 6也暂停。原因包括Hugging Face安全纰漏和Astra网络攻击能力越线。还采取物理隔离、严格监控、打击作弊等措施,或有营销意图。
刚刚,OpenAI挖来黑客「祖师爷」!
OpenAI近期动作不断,菲尔兹奖得主、翁荔之后,黑客圈“祖师爷”Halvar Flake(真名Thomas Dullien)官宣入职。他是BinDiff之父,在谷歌有诸多成果,还参与开源项目用Claude修bug,此时加入或因GPT安全事件频发。
Anthropic 最强模型 Mythos 发布了,但你暂时用不上
4月7日,Anthropic公布全新前沿模型Claude Mythos Preview,但未开放给公众,而是用于网络安全防御项目Project Glasswing。该模型安全能力强大,能发现大量零日漏洞并编写攻击代码,普通用户短期内难用上。
“无限可能”AI视频竞演第二阶段结果揭晓,11部作品入围深圳路演大会
3月8日,“无限可能”AI视频竞演完成二阶段评审,11部作品从50部入围作品中选出,晋级3月14日深圳路演大会。作品经“幻镜”AI视听测评季第三季测评,结果将现场公布。
Anthropic 提出透明度框架以保障前沿 AI 发展
Anthropic提出新透明度框架,针对大型AI公司,实施安全开发框架评估并减轻潜在风险,要求公开披露SDFs和系统卡片,小型公司豁免,还设执行合规条款,旨在平衡安全与创新。
谷歌DeepMind:AGI不必是巨型模型,拼凑型AI群或率先涌现,管理大规模Agent迫在眉睫
DeepMind最新研究提出,AGI未必以单一巨型模型形式出现,可能由多个次级AGI智能体协作拼凑涌现。为此,团队提出分布式AGI安全框架,包含四层深度防御模型应对新安全挑战。
Anthropic 为 Claude Code 添加了沙箱和 Web 访问功能,以实现更安全的 AI 驱动编码
Anthropic为Claude Code发布沙箱功能及基于Web的工具版本,解决编码安全风险。沙箱有文件系统和网络隔离两个边界,能减少权限提示、增强保护,还解决了传统安全系统的限制。
Q:Lab · 龙虾季 | 直播预告
InfoQ中国推出AI产品测评直播栏目「Q:Lab」,第一季“龙虾季”聚焦AI Agent产品,有3期直播,分别在4月21、23、27日,每期围绕职业场景测评多款产品,还有AICon 2026会议推荐。