「安全评测」共找到 1493 篇相关文章
重建安全,Kai种子轮拿了1.25亿美元,有点象龙虾
大模型用于网络攻击,传统安全跟不上节奏。初创公司Kai首笔融资1.25亿美元,它从根本上重建安全,用单一智能体AI平台自主完成安全工作,愿景是整合网络安全和IT功能。
首篇以第一性原理剖析OpenClaw自进化AI社会的论文
截止发文,OpenClaw项目已达192k Star,其衍生的AI Agents社会网络moltbook聚集大量智能体。北邮等团队首次从第一性原理研究,提出“自进化不可能三角”理论,还给出缓解策略。
速度提升,能力却暴跌?扩散模型做智能体的残酷真相
南洋理工大学陶大程教授团队联合发布评测报告,揭示扩散语言模型在智能体能力上有系统性缺陷,落后自回归模型。还分析其失败原因,提出评测框架,明确能力边界并给出研究建议。
机器人长出800个心眼?阿里达摩院开源具身新大脑,硅谷又坐不住了
2026年具身智能竞争激烈,阿里达摩院开源RynnBrain“具身大脑”。它采用分层架构,在16项评测中超越前沿模型。还介绍了核心技术、训练策略等,且全系列模型、评测基准和代码均开源。
超硬核,腾讯给力!
文章介绍腾讯朱雀实验室开发的AI安全红队测试平台A.I.G,能对AI系统做全面“安全体检”,覆盖AI基础设施、MCP、LLM等风险。它功能实用,安装简单,适合折腾AI服务或MCP的人。
蚂蚁 | 提出代码检索/重排基准:CoREB,揭开高分榜背后的三大幻觉,现已接入MTEB
蚂蚁研究人员提出代码检索与重排评测基准CoREB,解决现有基准相关性软、数据污染、任务方向单一问题。它已集成进MTEB,收录19个模型×6个任务评测结果,为代码检索模型评估提供新基线。
靠“AI 云”爆红的 Vercel,栽在一个第三方AI工具手里!IPO前夕遭黑,200万美元赎金谈崩?
近日,云平台 Vercel 遭入侵,攻击者通过被入侵的第三方 AI 工具 Context.ai 实施攻击。Vercel 确认‘安全事件’,称少量客户受影响,谷歌 Mandiant 团队协助调查。此事发生在其 IPO 前夕,或引发连锁安全暴露。
「养龙虾」翻车实录:D盘没了、账号废了、余额清空了……
当下「养龙虾」(安装并训练 OpenClaw)火爆,腾讯、字节跳动等大厂纷纷入局,资本市场也很沸腾。但普通人「养龙虾」却状况百出,存在安全风险且烧钱,工信部也发布了安全预警。
“银发”与“芯”征途:中国“十五五”规划展望及其影响
本报告预测中国‘十五五’规划(2026 - 2030年)是国家动员蓝图,核心为韧性、自立和安全。战略从‘经济为主’转向‘安全与经济并重’等,还阐述对个人与市场影响,如职业规划和投资方向。
无需训练的LLM对齐方法综述
大型语言模型应用引发担忧,传统微调方法有短板,免训练对齐(TF Alignment)应运而生。本文是首篇系统综述TF对齐技术的论文,提出三阶段分类框架,实验显示TF方法优势明显,还指明未来研究方向。