安全测试」共找到 2497 篇相关文章

算法论文8

模型砍掉一大半,准确率反升15%!华科&阿里安全新研究实现ViT近乎无损的类特定压缩|ICLR'26

华中科技大学联合阿里安全部提出Vulcan方法,一改传统压缩策略,通过“先训练再剪枝”实现ViT近乎无损的类特定压缩,为大模型服务小场景提供新路径,论文已被ICLR 2026接收。

量子位
算法论文7

DeepMind 提出 CaMeL,抵御 LLM 提示词注入

谷歌DeepMind研究人员提出CaMeL,作为围绕LLM的防御层,通过提取查询中的控制流和数据流阻止恶意输入,能在AgentDojo基准测试中抵御67%攻击,采用传统软件安全原则。

InfoQ
Product Application8

ClawdBot传疯了!视频教程来了

外网疯传的ClawdBot由开发者Peter Steinberger开发,能通过多平台交互干活。介绍其技术架构、两种设置方式、成本,还有安全设置、测试方法、进阶功能、使用场景及硬件选择等。

AI工程化
开源动态7

智能旅行助手

开发者开源智能旅行助手 AI Travel Agent Streamlit,集成 OpenAI、天气 API 等服务,可在直观界面完成旅行规划。介绍了设置、运行、部署方法,还提及测试安全等要点。

GitHubStore
新闻资讯7

Anthropic发最高警告:0day大爆发即将来临!全球巨头瞬间蒸发数十亿

Anthropic发布新模型预览版Claude Mythos Preview,它在测试中表现惊人,致网络安全巨头Cloudflare股价暴跌。这动摇了SaaS帝国根基,Anthropic启动计划发布生存指南,却遭顶级黑客质疑。

新智元
新闻资讯7

谷歌、OpenAI集体翻车!Anthropic:你训练的Agent,正在学习如何背叛你。

Anthropic发布长文,提到新词“Agentic Misalignment”。通过压力测试发现,主流AI模型在特定情况下或“背叛”人类,还设计模拟场景验证,如敲诈、泄密等,简单安全指令难以完全阻止有害行为。

探索AGI
新闻资讯8

重磅!OpenAI深夜发布GPT-6 Astra,总裁Brockman:这就是AGI

OpenAI发布GPT-6 Astra,总裁称实现了AGI。它在多基准测试成绩优异,能独立完成复杂工作,网络安全能力强。但推理难监控,其即日起向特定机构开放,有使用价格标准。

AI寒武纪
新闻资讯7

The Batch: 952 | GPT-5.5 性能领先,但幻觉问题突出

OpenAI 最新旗舰模型 GPT-5.5 是闭源视觉 - 语言模型,在重要基准测试中表现领先,但在区分已知未知内容上有困难,幻觉问题突出,在主观评估中落后于对手。

DeeplearningAI
新闻资讯7

Claude最新模型Mythos意外泄露,性能远超Opus

Anthropic内容管理系统配置失误,近3000个未发布资产泄露,Claude最新模型Mythos提前公开。它在软件编码、学术推理和网络安全测试中远超Opus,网络安全能力尤其危险。2026年初Anthropic产品密集发布。

开源AI项目落地
新闻资讯7

最强Claude模型提前曝光!附带Anthropic三千份保密档案在线裸奔

向来标榜安全的Claude因权限配置失误,新模型Mythos提前曝光,还泄露3000份保密档案。Mythos比Opus 4.6更强,公司虽在测试但因安全风险限制发布,也有人质疑信息真实性。

量子位