新闻资讯7
GPT与Claude对决,AI安全测试真相曝光
新智元
AI 摘要
OpenAI和Anthropic合作进行AI安全测试。Claude 4在指令优先级测试中全场最佳,OpenAI o3、o4 - mini在越狱评估表现更好。特定任务关闭推理或减少越狱机会,开发者消息能强化指令遵循。
阅读原文 · 新智元
GPT正面对决Claude!OpenAI竟没全赢,AI安全「极限大测」真相曝光
OpenAI和Anthropic罕见合作,测试双方模型在幻觉等四大安全方面的表现。这场合作是AI安全的里程碑,百万用户每天的互动推动安全边界扩展。文中详细对比了GPT和Claude模型在各安全测试中的表现。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
新闻资讯7
Meta推出Hatch,模型切换引关注
Meta推出智能体平台Hatch,功能类似Manus,开发阶段用Claude,计划正式上线时切换到自研模型Muse Spark,10月推出新模型Watermelon。Hatch注重消费数字生活,与Meta社交生态深度绑定,高端订阅有默认分发优势,但面临真实环境考验。
量子位
推荐文章8
Anthropic 曝光 AI 原生研发手册
Anthropic 在官方博客发布两篇内部实践文章,《The AI-Native SDLC Playbook》讲 AI 承担多数编码工作时软件流程安排,《How Anthropic secures its AI-native software development lifecycle》谈流程自动化后安全体系建设。
CourseAI
新闻资讯8
OpenAI自研芯片性能超英伟达,2026年部署
8月25日,OpenAI公布自研推理芯片Jalapeño性能测试结果,首次给出其在多款公开大模型上的具体数据。该芯片在低功耗下实现高推理吞吐量和低延迟,性能超英伟达芯片,B0版已进入制造阶段。
DeepTech深科技
新闻资讯7
Opus 5.1本周发布,AI智能体赛道将洗牌
消息称Anthropic本周将发布Opus 5.1,其升级聚焦单Token智能水平,强化编程、推理、AI Agent能力;OpenAI 10万亿参数模型Bel完成预训练;企业选模型‘够用就好’,Anthropic Fable 5份额低。
新智元