算法论文8
Anthropic:Claude Agent对齐成果超人类4倍
PaperAgent
AI 摘要
Anthropic:用9个并行的Claude Opus Agent组成团队,花5天、约$18,000,将PGR从人类的0.23提升到0.97,证明有明确评估指标时,AI自动化研究可行。
阅读原文 · PaperAgent
Anthropic让9个Claude Agent花5天做出比人类强4倍的对齐成果
Anthropic发表Automated Weak - to - Strong Researcher,用9个并行的Claude Opus Agent组成自动化研究团队,5天就把PGR从人类的0.23提升到0.97,成本约$18,000,证明AI自动化研究可行。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
产品应用7
Anthropic 亲选 6 个 Claude Code 神作
Claude 官方晒出一批来自普通用户的 Claude Code 「神作」,覆盖实用工具、可视化创意和趣味应用等领域,如人脸涂鸦、医学影像查看器、代码库动态图等。这些项目反映出 Claude Code 正走出传统编程场景。
机器之心
开源动态7
Anthropic开源让AI说人话的skills
周末,Anthropic官方分享并开源内部常用的skills——eli5,其作用是让AI说人话,解决模型回复冗长啰嗦问题。还介绍了安装方法,指出从opus4.6起,模型coding和agent能力变强但人味淡。
探索AGI
新闻资讯8
奥特曼炮轰AI营销,OpenAI绝密模型曝光
OpenAI员工「手滑」暴露模型代号gpt - nathree,引发GPT - 6 Astra将至的猜测。Anthropic也有新模型曝光。同时,奥特曼在播客中认错、怒批行业营销话术,还分享了OpenAI的创业历程。
新智元
新闻资讯7
Anthropic:Claude暗中降智引风波
开发者argofowl排查后发现Claude Code将「high」推理程度读成原本「low」对应的值,原来Anthropic在做实验。科技博主曝光后AI圈炸锅,工程师虽回应,但Opus 5也被指降智。
新智元