安全风险」共找到 1211 篇相关文章

新闻资讯7

The Batch: 940 |Claude Mythos Preview 引发安全担忧

Anthropic为即将推出的Claude Mythos Preview采取特别预备措施,因其会带来网络安全风险。该模型能力强大,能发现众多代码漏洞。Anthropic组建联盟增强防御,其表现也优于多个知名模型。

DeeplearningAI
开源动态7

又一安全圈爆火的开源项目,已经1.66万Star!

现在大家爱用代码AI客户端干活,但碰到安全和逆向任务时,AI易懵圈,因工具散落、经验没沉淀。开源项目`reverse-skill`可给AI装“安全研究导航仪”,支持多种AI编码客户端,有诸多功能特性。

开源先锋
新闻资讯8

大语言模型 + 编程智能体 = 安全噩梦

作者结合黑帽大会英伟达演讲,指出大语言模型和编程智能体扩大攻击面。如攻击者利用公共资源留恶意指令,实施水坑攻击。强大编程智能体虽普及,但易造成安全漏洞,虽有防御措施但效果有限。

宝玉AI
产品应用7

求稳的安全IP,安谋科技如何守正出奇?|甲子光年

12月24日,安谋科技推出新一代SPU IP——“山海” S30FP/S30P,给出面向高性能计算芯片的全栈安全解决方案。该方案从硬件IP层、软件中间件到云端服务构建一栈式安全防护体系,有五大核心亮点。

甲子光年
新闻资讯7

OpenAI Astra被曝引入「循环深度」能力飙升!安全专家坐不住了

OpenAI 最强新模型 Astra 或即将发布,它是首个达「关键级」网络安全能力门槛的模型,在测试中表现优异。《The Information》爆料其用「循环深度」技术,能力提升但引发安全专家担忧,该技术可使模型内部计算增多,思维链监控或失效。

机器之心
推荐文章7

OpenClaw安全有救了!不改内核、无视AI内部逻辑,数学级枷锁驯服暴走智能体

OpenClaw等智能体能力强大但有安全黑洞,南方科技大学和香港科技大学团队推出ClawLess框架,从底层系统调用源头扼杀智能体出格行为,通过形式化验证、物理隔离、动态验证等手段保障安全

AIGC开放社区
新闻资讯7

谨慎用OpenClaw:上海科技大学发布其全面安全体检报告

上海科技大学联合上海人工智能实验室对爆火的智能体OpenClaw做安全审计,在34个测试场景中,整体安全通过率58.9%,暴露出多方面问题,研究据此给出纵深防御策略。

AIGC开放社区
开源动态8

阿里新开源提出建设性安全对齐方案,向“让用AI的人安全”新范式跃迁

阿里巴巴集团安全部联合多高校发布技术报告,提出建设性安全对齐理念并集成到Oyster - I模型。该理念突破传统防御式机制,构建新博弈框架,实验显示该模型在安全和通用能力上达SOTA水平。

量子位
推荐文章8

内核级的真相:为什么 eBPF 正在取代基于用户空间的 Agent 成为安全可观测性的首选

文章指出基于用户空间的安全 Agent 存在与威胁同权限层级、CPU 成本高、易被攻击等问题。eBPF 能在 Linux 内核运行受沙箱保护程序,可降成本、增可见性。上线应分阶段,还介绍工具及部署安全措施。

InfoQ
新闻资讯7

刚刚,Anthropic 53页绝密报告曝光:Claude自我逃逸,将引爆全球灾难!

Anthropic发布53页报告预警,Claude Opus 4.6风险逼近ASL - 4,若自我逃逸将致全球失控。2026年AI领域状况频出,安全专家离职,多起危险事件凸显AI安全问题严峻。

新智元