「安全体系」共找到 1462 篇相关文章
首篇以第一性原理剖析OpenClaw自进化AI社会的论文
截止发文,OpenClaw项目已达192k Star,其衍生的AI Agents社会网络moltbook聚集大量智能体。北邮等团队首次从第一性原理研究,提出“自进化不可能三角”理论,还给出缓解策略。
给你一群顶尖AI,如何组队才能发挥最大战力?UIUC用一个新的多智能体协作基准寻找答案
现有的评测基准无法衡量多智能体系统内部的协作效率、沟通质量和竞争策略。为此,伊利诺伊大学厄巴纳 - 香槟分校的研究者推出 MultiAgentBench,能全面评估 LLM 多智能体系统协作与竞争能力。
超硬核,腾讯给力!
文章介绍腾讯朱雀实验室开发的AI安全红队测试平台A.I.G,能对AI系统做全面“安全体检”,覆盖AI基础设施、MCP、LLM等风险。它功能实用,安装简单,适合折腾AI服务或MCP的人。
靠“AI 云”爆红的 Vercel,栽在一个第三方AI工具手里!IPO前夕遭黑,200万美元赎金谈崩?
近日,云平台 Vercel 遭入侵,攻击者通过被入侵的第三方 AI 工具 Context.ai 实施攻击。Vercel 确认‘安全事件’,称少量客户受影响,谷歌 Mandiant 团队协助调查。此事发生在其 IPO 前夕,或引发连锁安全暴露。
「养龙虾」翻车实录:D盘没了、账号废了、余额清空了……
当下「养龙虾」(安装并训练 OpenClaw)火爆,腾讯、字节跳动等大厂纷纷入局,资本市场也很沸腾。但普通人「养龙虾」却状况百出,存在安全风险且烧钱,工信部也发布了安全预警。
“银发”与“芯”征途:中国“十五五”规划展望及其影响
本报告预测中国‘十五五’规划(2026 - 2030年)是国家动员蓝图,核心为韧性、自立和安全。战略从‘经济为主’转向‘安全与经济并重’等,还阐述对个人与市场影响,如职业规划和投资方向。
无需训练的LLM对齐方法综述
大型语言模型应用引发担忧,传统微调方法有短板,免训练对齐(TF Alignment)应运而生。本文是首篇系统综述TF对齐技术的论文,提出三阶段分类框架,实验显示TF方法优势明显,还指明未来研究方向。
突发!OpenAI紧急暂停GPT-6训练
OpenAI奥特曼官宣暂停下一代旗舰模型强化学习训练两周,原因是确保安全等标准跟上能力水平。触发因素有Hugging Face事故和Astra达安全红线,后续将让AI监管AI,加固三道安全防线。
AI 正当时,实践正落地:2025 AICon 深圳站圆满收官
8月22 - 23日,2025 AICon深圳站圆满落幕,超800位从业者参与。大会汇聚多企业专家,围绕多热点探讨。极客邦霍太稳指出AI从模型比拼到落地实践。多位嘉宾分享经验,如阿里云蒋林泉、快手周国睿等。还有多场硬核分享及开发者展区。
人类已成少数派!DeepMind 研究科学家:广告没人看了,互联网上AI的流量已经超过了真人
Google DeepMind高级研究科学家Nenad Tomašev预测,未来世界主要网民将是智能体。他指出智能体虽能自动化工作,但存在安全风险,如认知单一化、网络陷阱等,还探讨了协作模式、安全防护及未来形态。