算法论文8
Anthropic:大模型开始具备内省能力
深度学习自然语言处理
AI 摘要
Anthropic研究:最先进大模型如Claude Opus 4/4.1具内省能力,能感知内部念头、区分内外状态。不过能力不稳定、依赖训练和语境。此研究为诚实AI提供技术路径。
阅读原文 · 深度学习自然语言处理
Anthropic:大模型开始意识到自己在想什么!
Anthropic的Jack Lindsey论文《Emergent Introspective Awareness in Large Language Models》对大模型做神经科学受控实验。发现Claude Opus 4/4.1能感知内部念头,区分内外状态,通过检查内部状态一致性判断输出意图。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
新闻资讯7
Fable 5.1泄露,Claude全球大宕机!
今日,Fable 5.1被曝开启灰度测试,部分Claude用户已免费试用。推测其可能很快全量推送且不涨价。此前Fable 5因性能强受限,开发者期待5.1版。同日Claude全球大宕机,Anthropic正冲刺万亿估值。
新智元
新闻资讯7
Anthropic营收反超OpenAI,IPO占优
IPO前夕,Anthropic最新年化营收达650亿美元,8个月翻超7倍,反超OpenAI。双方在资本市场竞争激烈,A社在起跑时间、财务、商业模式上占优,但OpenAI用户规模和产品生态占优,目前A社牌面更好。
量子位
新闻资讯7
Anthropic雪藏Mythos 2,秘密研发Mythos 3
SemiAnalysis内部播客爆料,Anthropic新模型Mythos 2训练完成却被雪藏,正用其生成数据研发Mythos 3。Anthropic曾呼吁监管,如今自食其果。此外,OpenAI的Astra也因安全问题暂停部分活动。
新智元
新闻资讯8
Anthropic年化营收破650亿冲刺IPO
据彭博社报道,截至今年7月底,Anthropic年化营收运行率达650亿美元,数月间增长至原来7倍多,Q2初步收入是去年同期约14.6倍。其正向调整后营业利润显现经营杠杆,或10月上市,估值超2万亿美元。
机器之心