新闻资讯8
Anthropic发布新模型,剑指网络安全!
机器之心
AI 摘要
Anthropic:发布Claude Mythos Preview,它在漏洞挖掘等方面能力强大却危险,暂不全面开放;发起Project Glasswing,联合巨头、注资开源,欲构建AI防御联盟。
阅读原文 · 机器之心
Claude Mythos Preview来了!强大又危险,Anthropic还专门组了个研究团
今日凌晨,Anthropic发布Claude Mythos Preview新模型及AI网络安全项目Project Glasswing。该模型虽性能卓越,但有安全风险,Anthropic暂不全面开放。Project Glasswing汇聚众多巨头,获巨额资金支持,旨在构建AI防御联盟。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
产品应用8
阿里云平台完成 DeepSeek Harness 评测
本文分享基于阿里云 AgentLoop 平台的 DeepSeek Harness 评测实践。介绍了 DeepSeek Harness 工程架构,阐述 AgentLoop 平台接入方式及价值,还详述评估器设计思路、展示评测结果,最后总结方法论并展望后续工作。
阿里云开发者
新闻资讯7
Fable 5.1泄露,Claude全球大宕机!
今日,Fable 5.1被曝开启灰度测试,部分Claude用户已免费试用。推测其可能很快全量推送且不涨价。此前Fable 5因性能强受限,开发者期待5.1版。同日Claude全球大宕机,Anthropic正冲刺万亿估值。
新智元
新闻资讯7
OpenAI:暂停前沿模型强化学习训练
OpenAI发文称暂停最新模型强化学习训练两周,加固研究环境、进行红队测试等。部分低风险训练已恢复,最大规模前沿模型训练仍暂停。此举源于Hugging Face安全事故及Astra模型潜在风险。
机器之心
开源动态7
HarnessEval开启RSI时代新评测范式
过去一年AI进入RSI时代,但评测方式仍停留在过去。MirroS联合多方发布HarnessEval,将Harness引入评测领域,使评测成为具备自我进化能力的智能系统,还率先应用于交互式世界模型评测。
特工宇宙