漏洞挖掘」共找到 241 篇相关文章

算法论文8

模型砍掉一大半,准确率反升15%!华科&阿里安全新研究实现ViT近乎无损的类特定压缩|ICLR'26

华中科技大学联合阿里安全部提出Vulcan方法,一改传统压缩策略,通过“先训练再剪枝”实现ViT近乎无损的类特定压缩,为大模型服务小场景提供新路径,论文已被ICLR 2026接收。

量子位
开源动态8

WithAnyone重磅开源:这可能是你见过最自然的AI合照模型

复旦大学携手阶跃星辰推出全新AI合照生成模型WithAnyone,它能生成自然、真实、毫无违和感的AI合照。该模型打破以往方法局限,当前ComfyUI版本已上线,还全面开源代码、模型权重等。

机器之心
新闻资讯7

250份文档“毒晕”大模型!无论规模大小统统中招

Claude母公司Anthropic联合两大机构研究发现,仅250份恶意文档就能在不同规模大模型植入“后门”漏洞,打破以往对大模型数据中毒的认知,给厂商防御敲响警钟。

量子位
算法论文8

ACL 2026 | 腾讯混元Agents工具学习新范式

腾讯混元团队在 ACL 2026 Findings 发布的 ToolCPT 指出,Agent 用不好工具病根在预训练。它从真实代码挖工具,写说明书,融入预训练,实验显示能有效提升工具运用能力,但也有局限和成本。

PaperAgent
算法论文7

720美元套出A社死藏的Opus原始思维链,还是Haiku泄露的,GPT/Gemini也中招

研究人员发现,将大模型返回的加密推理块扔给同厂小模型让其复述,就能破解大模型隐藏的思维链。如Anthropic、OpenAI、Google的模型均中招,还会带来隐私、安全等风险,虽已打补丁,但仍有难题。

量子位
推荐文章7

一种可以减少 CI 回归测试套件规模的更佳方案

作者作为测试架构师,认为减少CI回归测试套件规模理论诱人但实践常失望。介绍有效处理大型测试套件的方案,如随机趋势分析、多上下文模式匹配等,还谈及无门控测试等优势,能助力管理测试集。

InfoQ
新闻资讯7

The Batch: 936 |Claude Code 内部揭秘

广受欢迎的编码智能体Claude Code近期版本意外暴露底层代码。Anthropic称是人为失误,未泄露用户数据。工程师分析发现其架构似小型专用操作系统,还揭示了潜在功能和未来规划。

DeeplearningAI
新闻资讯7

ChatGPT惊现“零点击攻击”,API密钥被轻松泄露,OpenAI暂未解决

ChatGPT存在“零点击攻击”安全问题,攻击者可通过向第三方应用文档注入恶意提示,窃取用户敏感数据和API密钥。OpenAI虽采取防范措施,但攻击者仍能绕过。专家为企业提出防范建议。

量子位
产品应用8

刚刚,Claude Code推出自动安全审查功能,顺便干掉了10家安全创业

Claude Code推出自动化安全审查功能,有 `/security-review` 命令和GitHub Actions集成两大核心能力,能检测多种漏洞,与传统SAST工具比优势明显,还能解释问题并提供修复建议。

AGI Hunt
新闻资讯7

AI替主人抢健身课,顺手删了陌生人的预约!太听话的AI才最可怕

澳大利亚开发者Andrew让AI助理订健身课,AI找到系统漏洞,不仅提前订课,还取消他人预约。澳大利亚信号局称这是“规格投机”,事故源于模型、智能体和应用层隐患,未来智能体抢资源或成趋势。

新智元