「AI安全研究」共找到 10992 篇相关文章
不读博士,照样进OpenAI!o1核心成员现身说法了
OpenAI研究员Noam分享Keller Jordan、Sholto Douglas等“非典型”研究员经历,他们主动性强、公开研究,无博士学位也进入前沿AI实验室。现在进大厂,博士学位非必需,尽早进厂更好。
年度AI论文!全球三大顶尖模型的防蒸馏机制全面告破:小模型“套出”大模型隐藏思维链,Kimi-K3重现概率异常
这篇论文指出三大前沿AI模型厂商API有密码学旁路漏洞,攻击者用轻量级模型就能恢复大模型隐藏思维链数据。还揭示部分模型训练或借鉴大模型思维链,此漏洞也致企业数据隐私安全问题。
突发!OpenAI收购失败,windsurf被谷歌一锅端
原定OpenAI收购AI编程初创公司Windsurf交易取消,其CEO等核心人员转投谷歌DeepMind,围绕Gemini研究“代理编码”。谷歌是“人才聘用”,获部分技术非排他许可,Windsurf继续运营。
ICLR 2026|CMU等团队让AI生成的3D场景真正「站得住」:PAT3D把文生3D从能看推进到能模拟、能交互
现在3D AIGC虽能快速生成场景,但落地有问题,很多场景物理模拟时会暴露物体悬空等问题。CMU等团队提出PAT3D,目标是让生成的3D场景物理上站得住,可用于编辑、交互和仿真,且代码已开源。
MIT终身教授何恺明,入职谷歌了
AI大牛何恺明刚拿下MIT终身教职,便加盟谷歌DeepMind任杰出科学家,此次为兼职。他与谷歌早有研究合作,此前在CV领域成果丰硕,谷歌学术总引用超71万次。
DeepMind 提出 CaMeL,抵御 LLM 提示词注入
谷歌DeepMind研究人员提出CaMeL,作为围绕LLM的防御层,通过提取查询中的控制流和数据流阻止恶意输入,能在AgentDojo基准测试中抵御67%攻击,采用传统软件安全原则。
Karpathy加入Anthropic要做的事,被Google提前做了
Karpathy官宣加入Anthropic要组建新团队‘用Claude加速预训练研究’,话音未落,Google&Meta等发论文‘LLMs Improving LLMs’验证了该思路。论文让Claude Code搜索最优推理策略,结果全面超越人类设计。
用雨伞「钓」无人机?首个针对自主目标跟踪闭环系统的物理攻击
加州大学尔湾分校研究人员用特制雨伞干扰无人机视觉系统,实现FlyTrap攻击,让无人机误判目标远去而失控俯冲。此攻击无需信号干扰,成功率超60%,有强泛化能力,揭示了AI感知系统安全隐患。
MCP 火爆半年后,是时候对它“祛魅”了
2024 年 11 月 25 日,Anthropic 发布的 MCP 协议意义重大,解决了 AI 模型与工具、数据源集成的碎片化问题。文章深入探讨其架构、价值、影响及趋势,还采访专家解答相关疑问。
李飞飞最新长文火爆硅谷
AI教母李飞飞发表长文,首次系统性解释空间智能,提出真正具有空间智能的世界模型须具备生成、多模态、交互三个核心能力,还分享World Labs进展及世界模型在多领域的潜力。