安全攻击」共找到 964 篇相关文章

开源动态8

浙江大学联合华为发布国内首个基于昇腾千卡算力平台的DeepSeek-R1-Safe基础大模型

2025年9月18日,浙江大学任奎教授团队联合华为在“华为全联接大会2025”发布国内首个基于昇腾千卡算力平台的DeepSeek-R1-Safe基础大模型,提升了我国AI系统自主安全防控水平,该模型已全面开源。

AIGC开放社区
算法论文8

首篇以第一性原理剖析OpenClaw自进化AI社会的论文

截止发文,OpenClaw项目已达192k Star,其衍生的AI Agents社会网络moltbook聚集大量智能体。北邮等团队首次从第一性原理研究,提出“自进化不可能三角”理论,还给出缓解策略。

PaperAgent
开源动态8

超硬核,腾讯给力!

文章介绍腾讯朱雀实验室开发的AI安全红队测试平台A.I.G,能对AI系统做全面“安全体检”,覆盖AI基础设施、MCP、LLM等风险。它功能实用,安装简单,适合折腾AI服务或MCP的人。

开源先锋
新闻资讯7

「养龙虾」翻车实录:D盘没了、账号废了、余额清空了……

当下「养龙虾」(安装并训练 OpenClaw)火爆,腾讯、字节跳动等大厂纷纷入局,资本市场也很沸腾。但普通人「养龙虾」却状况百出,存在安全风险且烧钱,工信部也发布了安全预警。

机器之心
新闻资讯8

“银发”与“芯”征途:中国“十五五”规划展望及其影响

本报告预测中国‘十五五’规划(2026 - 2030年)是国家动员蓝图,核心为韧性、自立和安全。战略从‘经济为主’转向‘安全与经济并重’等,还阐述对个人与市场影响,如职业规划和投资方向。

AI Reading Hub
算法论文8

无需训练的LLM对齐方法综述

大型语言模型应用引发担忧,传统微调方法有短板,免训练对齐(TF Alignment)应运而生。本文是首篇系统综述TF对齐技术的论文,提出三阶段分类框架,实验显示TF方法优势明显,还指明未来研究方向。

深度学习自然语言处理
新闻资讯8

突发!OpenAI紧急暂停GPT-6训练

OpenAI奥特曼官宣暂停下一代旗舰模型强化学习训练两周,原因是确保安全等标准跟上能力水平。触发因素有Hugging Face事故和Astra达安全红线,后续将让AI监管AI,加固三道安全防线。

新智元
新闻资讯7

AI系统10分钟生成CVE漏洞利用程序:网络安全攻防战进入“分钟时代”

研究人员开发的AI系统能10 - 15分钟生成CVE漏洞利用程序,成本约1美元,准确性和可靠性高。此外,HPTSA系统可利用零日漏洞。传统网络安全防御模式失效,攻防失衡加剧,AI攻防对抗趋势明显,有专业化、自主化、高强度特点。

AIGC开放社区
新闻资讯8

阿里安全AGI一次发布3款LLM,8B多维度领先GPT-5.4

近期,阿里安全AGI实验室发布3款Yuvion LLM,在AI安全与内容安全领域多维度领先。它以‘对抗即智能’为原则,构建五类数据体系,采用三阶段训练范式,通过YLRE四级评测体系验证能力。

PaperAgent
新闻资讯8

人类已成少数派!DeepMind 研究科学家:广告没人看了,互联网上AI的流量已经超过了真人

Google DeepMind高级研究科学家Nenad Tomašev预测,未来世界主要网民将是智能体。他指出智能体虽能自动化工作,但存在安全风险,如认知单一化、网络陷阱等,还探讨了协作模式、安全防护及未来形态。

AI科技大本营