「自我修正机制」共找到 1195 篇相关文章
Anthropic 的 Harness 设计:build to delete
Anthropic工程博客发布Harness设计文章,探讨Claude完成全栈应用开发任务。指出单Agent模式问题,采用GAN式对抗、三Agent编排,对比单Agent与多智能体产出,还介绍调教评估者及编排简化,提出Build to Delete原则。
AI 编程正在终结框架时代
作者认为自动化编程让人们摆脱繁重体力劳动,可专注重要创作。框架解决简化、自动化和劳动力成本问题,但带来诸多弊端。真正的软件工程已回归,应摆脱无用复杂性,自主构建产品。
郎园Station展讯|X美术馆新展预告:数字浮游——第六届北京电影学院国际新媒体艺术三年展巡回展
2026年3月7日至5月5日,X美术馆联合北京电影学院举办“数字浮游——第六届北京电影学院国际新媒体艺术三年展巡回展”。展览聚焦影像,汇集24位(组)艺术家26件作品,探讨数字时代创作机制。
Claude 5史诗级泄露,史上最强编程模型评测炸裂!核心秘密曝光
Anthropic的Claude Sonnet 5即将发布,已存在于谷歌基础设施中,性能领先谷歌‘Snow Bunny’一代。它价格比Opus 4.5便宜50%,有100万token上下文窗口,SWE - Bench成绩超80.9%,还有自动开发团队模型。
「重要性采样」并不「重要」?快手清华ASPO攻克重要性采样权重错配
快手与清华合作团队发现大语言模型结果监督强化学习中,重要性采样机制“失灵”,存在权重错配现象。为此提出算法ASPO,在多基准测试中展现优势,训练更稳定。
Agent能自己“复盘”和“进化”,这个开源框架牛了!
文章介绍了自进化AI,其核心是执行、评估、进化的反馈循环,能自动修改Prompt和工作流。还讲解了SEW、TextGrad等优化器原理,并以SEW为例展示逻辑,最后推荐开源框架EvoAgentX。
Claude正式登陆Xcode
Xcode 26更新对Claude原生支持,将AI编程助手融入代码编辑器。开发者可在Xcode用Claude加速开发,有代码助手和编码工具等功能,订阅机制合理,还给出启用方式。
Meta提出StepWiser,让模型学会“反思”自己的推理过程
Meta提出StepWiser解决大语言模型推理逻辑正确性问题。它训练生成式评判模型,通过强化学习在线训练,能解释推理步骤好坏。实验显示其远超传统方法,为构建可靠AI系统提供新思路。
告别「面瘫」配音,InfiniteTalk开启从口型同步到全身表达新范式
传统video dubbing技术有局限,新兴模型也有问题。美团视觉智能部研发的InfiniteTalk引入‘稀疏帧video dubbing’,实现口型、表情、肢体与音频自然对齐,解决长视频生成难题,技术已开源。
Hinton预言「AI妈妈」刷屏硅谷!李飞飞:人类或将毫无尊严
在Ai4 2025大会上,“AI教父”Hinton警告人类难控AI,提出建立“AI母亲”,让AI关心人类;“AI教母”李飞飞反对,呼吁打造“以人为本的人工智能”,维护人类尊严。