推荐文章7
翁荔:递归自我提升或始于Harness优化
DeepTech深科技
AI 摘要
翁荔:通向递归自我提升或先从优化模型外的Harness开始,虽有成果,但研究面临评估、安全等挑战,需人类把控方向,兼顾长期指标。
阅读原文 · DeepTech深科技
翁荔最新博客:我们可能高估了模型,却严重低估了那层“脚手架”
前OpenAI安全研究副总裁翁荔在新博客聚焦AI领域Harness Engineering。她认为Harness是决定模型在现实任务中走多稳、多远的‘脚手架’,并梳理其演进路线,也指出研究面临评估、安全等瓶颈。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
开源动态8
Bright Data CLI:让Agent上网不再尴尬
约6.4k Star的Bright Data CLI想解决AI Agent访问网页难题,把网页变成易被模型读懂的材料。它将网页访问能力拆成终端可组合动作,还关注工程化细节,让Agent上网有章可循。
小华同学ai
产品应用8
SemaPLC:让AI编程在PLC开发可交付
上海交通大学联合Sema研究团队推出SemaPLC,将AI Agent与PLC工程工具链连接,让自然语言需求转化为可编译、验证、仿真的控制程序。它是面向全流程的智能工作台,实验效果优于业界方案。
量子位
开源动态8
Headlong:让AI Agent成为主动思考的“同事”
Laude Institute的AI Agent Audel在无指令下自动修复bug,背后是开源的AI Agent微框架Headlong。它与其他Agent不同,其Agent永远不睡觉,核心由9800行Bash脚本构成,安装简单,提出AI主体性问题。
开源星探
推荐文章7
Vasuman:企业 AI 采用率指标是个笑话
一家公司买企业级 AI 授权全员铺开,虽 88% 员工采用,但交付速度未变,仅 10% 的人烧掉 90% 的 Token。文章指出企业 AI 采用率指标荒诞,分析企业 AI 应用现状,还给出落地推进建议。
特工宇宙