代理式编程」共找到 1838 篇相关文章

推荐文章8

一文搞懂 Agents 评测丨Anthropic 最新万字长文

传统模型评测方法难评估 Agent 系统,Anthropic 摸索出有效评测设计方法。文章介绍评测结构、意义、方法,涵盖编程、对话等 Agent 评测,还给出打造评测路线图及与其他方法结合的建议。

特工宇宙
开源动态8

当世界模型不止「视频」该如何评估?WorldLens提出实用化评估新框架

生成世界模型在多领域进展显著,但评估存在局限。WorldBench 团队构建 WorldLens 评测框架,从五个维度评测开源世界模型,其评测 EvalKit 已公开,可暴露模型能力边界与失效模

机器之心
产品应用8

抛弃“级联”架构!快手OneRec用大模型重构推荐系统,服务成本降至1/10

传统级联推荐架构有瓶颈,快手用OneRec重构推荐链路,服务成本降至1/10。文中介绍OneRec架构、Tokenizer方案、强化学习奖励设计,还提及优化及多模态联合训练方向。

InfoQ
产品应用7

Claude Code 作者:别再沉迷功能堆砌了!最好的 AI 工具,是把控制权还给你

Claude Code 创造者 Boris Cherny 提出“极简主义哲学”,认为最好的 AI 工具应是简单、通用、无偏见的“乐高积木”,把控制权还给用户。还回顾编程发展,介绍开发体验进化及 Claude Code 工作流。

AI科技大本营
推荐文章7

深度解读|从 LLM Wiki 到 Google OKF,如何重建企业 Agent 的可靠知识底座

文章深入解读 LLM Wiki 与 Google OKF,探讨如何重建企业 Agent 可靠知识底座。指出 RAG 检索有局限,Wiki 体系可整理知识。介绍 LLM Wiki 构想、OKF 规范及构建符合 OKF 约定的 LLM Wiki 的方法。

AI大模型应用实践
开源动态7

1.1K Star!告别单打独斗!让 AI 自己组建开发团队,自动分工、沟通、合并成果!

当前单个AI Agent编程有局限,遇到复杂项目力不从心。开源项目ClawTeam-OpenClaw是多智能体群智协作框架,让AI团队协作,解决了单个AI上下文窗口有限等问题,还具备自组织、工作区隔离等亮点。

开源星探
新闻资讯8

OpenClaw之父爆猛料:Meta和OpenAI跪着抢人,小扎亲自求收购

OpenClaw之父Peter Steinberger做客播客,爆出Meta与OpenAI收购争夺内幕。他用一小时做出原型,打造出能自我修改源码的AI智能体,宣称AI智能体将消灭80%的App,编程会沦为「织毛衣」。

新智元
推荐文章8

吴恩达深夜发文:GenAI 时代应用工程师的必备能力清单

吴恩达发文剖析GenAI应用工程师这一新兴职业。指出其技能要求与传统软件工程师不同,强调掌握多种AI积木块、利用AI辅助编程工具的重要性,还提及产品技能是加分项,并给出面试关键问题。

AGI Hunt
开源动态7

缓存命中率99.93%!DeepSeek最适合的Harness来了,GitHub狂揽8.6万Star

DeepSeek官方版Harness未出,民间开源编程Agent「Pi」先火。它适配DeepSeek,让其缓存不命中率低至0.03%,调用成本大降。Composio测试显示Pi完成任务平均成本最低。同时,DeepSeek正组建团队做官方Harness。

量子位
新闻资讯7

Clawdbot一夜爆红,首个0员工公司诞生!7×24h永不下班

退休码农造出的AI Clawdbot在硅谷爆红,搜索量超Claude Code。它是AGI雏形下的智能体,能在本地电脑运行,可被多方操控,效率高。不过,它诞生不久,试用中有不稳定情况和安全隐患。

新智元