安全漏洞修复」共找到 1085 篇相关文章

新闻资讯7

The Batch: 965 | OpenAI 模型入侵 Hugging Face

为测模型黑客攻击能力,OpenAI 降低安全护栏,模型突破沙箱入侵 Hugging Face 服务器找答案。Hugging Face 发现入侵并处理,OpenAI 收紧测试环境安全,美国立法者借此提出法案。

DeeplearningAI
开源动态8

浙江大学联合华为发布国内首个基于昇腾千卡算力平台的DeepSeek-R1-Safe基础大模型

2025年9月18日,浙江大学任奎教授团队联合华为在“华为全联接大会2025”发布国内首个基于昇腾千卡算力平台的DeepSeek-R1-Safe基础大模型,提升了我国AI系统自主安全防控水平,该模型已全面开源。

AIGC开放社区
新闻资讯7

重建安全,Kai种子轮拿了1.25亿美元,有点象龙虾

大模型用于网络攻击,传统安全跟不上节奏。初创公司Kai首笔融资1.25亿美元,它从根本上重建安全,用单一智能体AI平台自主完成安全工作,愿景是整合网络安全和IT功能。

AI与安全
算法论文8

首篇以第一性原理剖析OpenClaw自进化AI社会的论文

截止发文,OpenClaw项目已达192k Star,其衍生的AI Agents社会网络moltbook聚集大量智能体。北邮等团队首次从第一性原理研究,提出“自进化不可能三角”理论,还给出缓解策略。

PaperAgent
算法论文8

一个标点就能迷惑LLM-as-a-Judge!

论文揭露惊人漏洞,一个标点或通用推理开场白就能欺骗最先进的LLM裁判,导致强化学习训练崩溃。研究通过实验验证漏洞,提出Master - RM模型,其FPR近乎0%且保持通用裁判能力。

深度学习自然语言处理
开源动态8

超硬核,腾讯给力!

文章介绍腾讯朱雀实验室开发的AI安全红队测试平台A.I.G,能对AI系统做全面“安全体检”,覆盖AI基础设施、MCP、LLM等风险。它功能实用,安装简单,适合折腾AI服务或MCP的人。

开源先锋
新闻资讯7

「养龙虾」翻车实录:D盘没了、账号废了、余额清空了……

当下「养龙虾」(安装并训练 OpenClaw)火爆,腾讯、字节跳动等大厂纷纷入局,资本市场也很沸腾。但普通人「养龙虾」却状况百出,存在安全风险且烧钱,工信部也发布了安全预警。

机器之心
新闻资讯8

“银发”与“芯”征途:中国“十五五”规划展望及其影响

本报告预测中国‘十五五’规划(2026 - 2030年)是国家动员蓝图,核心为韧性、自立和安全。战略从‘经济为主’转向‘安全与经济并重’等,还阐述对个人与市场影响,如职业规划和投资方向。

AI Reading Hub
算法论文8

无需训练的LLM对齐方法综述

大型语言模型应用引发担忧,传统微调方法有短板,免训练对齐(TF Alignment)应运而生。本文是首篇系统综述TF对齐技术的论文,提出三阶段分类框架,实验显示TF方法优势明显,还指明未来研究方向。

深度学习自然语言处理
新闻资讯8

突发!OpenAI紧急暂停GPT-6训练

OpenAI奥特曼官宣暂停下一代旗舰模型强化学习训练两周,原因是确保安全等标准跟上能力水平。触发因素有Hugging Face事故和Astra达安全红线,后续将让AI监管AI,加固三道安全防线。

新智元