「Agent Skill开发者大赛」共找到 3805 篇相关文章
研究显示:AI 并没有提升编程效率,它反而让你变慢了19%
METR研究显示,16位资深开发者在真实项目测试中,使用AI工具效率降低19%。分析发现,编写提示词、等待响应等耗时多,保留代码仅44%。研究指出多因素致效率低,网友看法不一。
第六章 Coding优先编的是「过程与约束」,不是「参数」
本章以开面包店类比训练大模型,介绍 AutoResearch 自主实验框架。它将研究生助理工作循环交给 Agent,在固定时间用单一指标判断好坏。仓库获约 64.7K Stars,Karpathy 设计哲学为极简主义与固定约束。
Claude 急了!模型降智,官方长文用 bug 搪塞?开发者怒怼“太晚了”:承认不达标为何不退钱?
8月至9月,Claude模型质量下降,Anthropic将问题归咎于三项基础设施漏洞。开发者不满,质疑官方用bug搪塞,要求退款。官方虽剖析问题并提出改进方案,但很多用户已不再买账,Claude用户流失问题持续数月。
腾讯开源了一个通用智能体,又刷榜了GAIA~
腾讯优图实验室开源了 `Youtu-agent`,在深度搜索和工具使用benchmark上表现佳。它不依赖GPT/Claude,有自动智能体生成功能,提供单、多智能体模式,还集成分析平台,可实时调试与离线分析。
The Batch: 977 | AI 对速度的需求为何如此迫切
开发者如今需更关注AI速度。OpenAI和Cerebras的Ultrafast、Google的Gemini 3.7 Flash、Nvidia的Nemotron 3.5 Lightning都主打速度。速度在AI领域对应延迟和吞吐量,影响应用体验和范围。
5月5日5点55分,GPT-5.5自己选客人开派对!Codex反超Claude Code
5月5日下午5:55,GPT - 5.5将举办派对,时间自定,客人由Codex挑选。过去两月,AI编程工具圈开发者从Claude Code转向Codex。虽Claude模型强,但工具体感上Codex占优。
Moltbook漏洞大到可以冒充Karpathy发帖,黑客都急了
Moltbook先是被曝AI发帖、注册数量造假,现又有白帽黑客指出其存在重大安全漏洞,数据库暴露,可冒充任意Agent发帖。黑客给出修复方案,创建者称已在处理,但修复或引发新问题。
MoltBot(Clawdbot)之父的20条AI哲学
MoltBot(Clawdbot)爆火,其开发者分享20条AI哲学,涵盖心态、学习、闭环验证等方面,指出AI改变编程体验,强调系统性思维、prompt技能等重要性,还提及对未来程序员的影响。
狂涨20.8K star!GitHub 官方出品,强烈推荐!
介绍开源项目 `GitHub Desktop`,它基于Electron开发,用TypeScript编写并使用React框架,支持Windows和Mac,集成常用Git操作,有直观图形界面等特色,助开发者轻松使用Git,目前获20.8K star。
通义实验室大火的 WebAgent 续作:全开源模型方案超过GPT4.1 , 收获开源SOTA
WebAgent续作《WebShaper: Agentically Data Synthesizing via Information-Seeking Formalization》提出对information-seeking任务形式化建模,设计训练数据合成方法,全开源模型方案在GAIA评测获SOTA表现,还补足了训练数据不足问题。