安全可观测性」共找到 4811 篇相关文章

推荐文章7

翁荔最新博客:我们能高估了模型,却严重低估了那层“脚手架”

前OpenAI安全研究副总裁翁荔在新博客聚焦AI领域Harness Engineering。她认为Harness是决定模型在现实任务中走多稳、多远的‘脚手架’,并梳理其演进路线,也指出研究面临评估、安全等瓶颈。

DeepTech深科技
算法论文7

Claude的脑子里,也长出了一块「意识」

Anthropic论文研究Claude潜意识与意识,发现其内部有类似人脑功能分层,揪出J - space。经多实验验证其特性,还能用J - lens检验AI“心里话”,但离“AI有意识”尚远。

量子位
算法论文8

Anthropic 在 Claude 内部发现"全局工作空间",以直接读取模型没说出口的想法

Anthropic发布研究,在Claude内部发现J - space(雅比空间),即“全局工作空间”,它在训练中自发形成。用雅比透镜技术读取其内容,还验证了其功能属性,用于对齐审计等。

AI工程化
开源动态8

Claude、GLM、GPT谁才是真正的AI软件工程师?首个持续更新Visual Spec-to-App Benchmark发布

近年来,Coding Agent 发展迅速,「AI 软件工程师」渐成现实。但目前缺少系统评测其从设计稿开发产品能力的公开 Benchmark。为此,多校研究团队推出 VISTA,多维度评测 Coding Agent 开发能力,且持续更新。

机器之心
算法论文7

Claude 和 Manus 还要人工搭框架?小米直接让 Agent 自我进化

6月12日小米Darwin Agent Team发布论文《HarnessX》,用“系统自进化”终结Harness人工调优时代,带来性能跃升。其让Harness成为“一等公民”,有组合等特质,还能与模型协同进化,虽有局限但成热门方向。

AI科技评论
新闻资讯8

ICML 2026前瞻:投稿翻倍背后,机器学习正在换挡

第43届国际机器学习大会(ICML 2026)7月6 - 11日将在韩国首尔举行,主题为‘Machine Learning for the Real World’。今年投稿量翻倍,接收率26.6%,还做了两项制度调整。论文反映出LLM推理、AI安全、模型压缩等趋势,中国研究者表现亮眼。

AI科技评论
开源动态8

具身智能的Skill时刻!英伟达开源机器人技能库,Jim Fan:范式变了

英伟达开源能让机器人持续成长的技能库ASPIRE,类似机器人版Coding Agent,会沉淀机器人操作经验。英伟达机器人主管Jim Fan称其代表全新持续学习范式,论文实验验证其效果好于此前方法。

量子位
新闻资讯8

去了一趟中国AI实验室,Linux基金会CTO感叹:西方那两套偏见全破产了

Linux 基金会全球 AI 技术官 Matt White 访华后称,西方对中国 AI 的偏见破产。中国实验室文化黏性强、人才回流,工具反向输出美国。他指出西方出口管制未卡死中国,还让其成自研芯片‘卷王’,开源模型也更受青睐。

AI科技大本营
产品应用7

终于轮到 AI 上夜班了,我去睡

Qoder 推出 Qwen3.7-Max 和 Qwen3.7-Plus 错峰折扣,白天 08:00 到 22:00,Qwen3.7-Max 5 折;22:00 到次日 08:00,Qwen3.7-Max 2 折,Qwen3.7-Plus 4 折。作者测试后认为适合内容创作者,还给出使用建议。

AI产品黄叔
推荐文章8

翁荔最新博文深度拆解Scaling Laws:AI行业最信赖的公式,没有那么

6月24日,前OpenAI安全研究副总裁翁荔在博客发表长文,对缩放定律进行系统梳理,指出该理论在实际拟合和外推过程有易被忽视的陷阱,还讨论了数据有限时定律是否成立等问题。

DeepTech深科技