算法论文7
Claude Code Auto Mode压力测试误放行率高
机器之心
AI 摘要
香港科技大学与ETH Zurich研究团队:对Claude Code Auto Mode进行压力测试,发现其端到端误放行率达81.0%,部分危险状态改变通过项目内文件编辑绕过审核,整体表现有待提升。
阅读原文 · 机器之心
Claude Code新功能Auto Mode能否替代人工审核?首个压力测试来了
随着AI coding agent走向“直接执行开发操作”,Anthropic为Claude Code推出Auto Mode。香港科技大学与ETH Zurich研究团队对其进行首个系统压力测试,发现Auto Mode端到端误放行率达81.0%,部分危险操作绕过审核。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
新闻资讯8
Anthropic年化营收破650亿冲刺IPO
据彭博社报道,截至今年7月底,Anthropic年化营收运行率达650亿美元,数月间增长至原来7倍多,Q2初步收入是去年同期约14.6倍。其正向调整后营业利润显现经营杠杆,或10月上市,估值超2万亿美元。
机器之心
推荐文章7
Daisy Hollman:Claude Code 无‘魔法’,定制是关键
资深工程师 Daisy Hollman 在演讲介绍了 Claude Code 插件设计与上下文工程原语,以及 Anthropic 内部多 Agent 工作流。指出定制模型可放大能力,上下文窗口是关键,还探讨多种插件抽象与工作流扩展方式。
InfoQ
新闻资讯7
OpenAI:一键搬空Claude Code用户家当
AI编程大战中,OpenAI盯上对手用户的配置、技能等“家当”。8月11日其统一外部智能体导入说明,可将Claude Code等工具配置等搬入Codex,但只能进不能出,且部分内容无法迁移。
新智元
开源动态8
diagram - design:告别AI画图廉价感
技术写作者兼产品设计师Cathryn Lavery因不满Claude画图效果,开发开源项目diagram - design。它是Claude Code的技能插件,输出自包含HTML文件,有多种图表类型、品牌定制等亮点,解决AI画图审美痛点。
开源星探