攻击方式」共找到 963 篇相关文章

7

英伟达GPU被曝严重漏洞,致模型准确率暴跌99.9%

英伟达GPU被白帽黑客发现严重漏洞,通过GPUHammer攻击可使大模型准确率从80%降至0.02%。此攻击属Rowhammer类,直接对显存“物理动手”。英伟达建议的防御措施会使模型性能下降。

量子位
算法论文8

一个指令误导智能模型!北航等首创3D语义攻击框架,成功率暴涨119%

北京航空航天大学与中关村实验室团队提出全新框架InSUR,入选NeurIPS 2025。该框架可基于指令生成对抗样本,首次实现3D SemanticAE生成,从采样、建模、评估三方面突破,实验验证其有效性与可扩展性。

量子位
产品应用7

突破视频时长限制!Manus上架视频生成功能,网友:比Sora更好

Manus上架视频生成功能,可通过连续拼接突破时长限制。它按“拍电影”方式,根据提示词生成片段再合成故事。网友评价是新创作方式,但效果有提升空间,部分人认为比Sora好。

量子位
推荐文章7

5Y View|欢迎来到评测时代

强化学习推动AI突破,模型将刷爆既有评测,AI实验室面临评测饥荒。构建评测与RL环境是利用人类时间的高效方式,不同领域有不同验证方式,Mercor已率先拓展RL数据边界。

五源资本 5Y Capital
推荐文章7

国庆这8天,我发现和AI辩论才是最高效的学习方式

作者国庆假期与AI辩论,以自身关于AI时代信息筛选的观点为例,阐述和AI辩论是高效学习方式。先提出观点,后与AI多轮交锋,过程虽痛苦但能促使人思考、完善观点,还给出与AI辩论三步法。

数字生命卡兹克
推荐文章7

面对MCP"工具投毒",我们该如何应对

近期MCP爆火但安全风险显现,安全机构指其有严重漏洞,会致‘工具投毒攻击’。本文介绍通过客户端/服务器代码复刻攻击过程,剖析MCP客户端和服务端安全风险,还给出阿里云的两种安全监控方案。

阿里云开发者
新闻资讯7

AI 找到了六个 Erdos 数学问题,陶哲轩:AI + 人类专家才是真正改变科学研究的方式

菲尔兹奖得主陶哲轩分享,AI 在 Erdos 问题网站实验中,帮数学家发现六个原本标记为「未解决」的问题其实已被解决。他认为 AI 有价值的应用是处理枯燥日常工作,如文献搜索。

AGI Hunt
开源动态8

打破AI能力的惯性评估方式,红杉中国推出全新双轨基准测试xbench|甲子光年

红杉中国推出全新AI基准测试工具xbench,采用双轨评估体系,构建多维度测评数据集,追踪模型理论能力上限与Agent实际落地价值。还采用长青评估机制,首期发布两个核心评估集并给出综合排名,公开后邀各界完善。

甲子光年
算法论文8

TPAMI 2025 | AI对抗迁移性评估的「拨乱反正」:那些年效果虚高的攻防算法们

本文第一作者赵正宇来自西安交大,针对现有迁移攻击方法缺乏系统公平对比分析的问题,将其分为五大类,在 ImageNet 上对 23 种攻击与 11 种防御方法开展评估,证实评估缺陷会误导结论,解决后有新见解。

机器之心
开源动态7

Harness Engineering 的防御视角:从 Codex Security 看 AI 生成代码的治理

作者用 Codex Security 分析项目,发现它不仅列漏洞,还提供攻击路径等。AI 没创造新漏洞,却放大缺陷,需新方式治理大规模自动生成代码,Harness Engineering 有防御价值。

phodal