「coding Agent」共找到 3263 篇相关文章
Claude Code 究竟牛在哪里?(以及如何在你的 AI 智能体中复刻它的魔法!)
文章介绍Claude Code是出色的AI智能体,比Cursor等好用。它设计简单,提示词和工具弥补模型缺点。作者基于使用经验,给出打造类似智能体的要点,包括控制循环、提示词、工具和可引导性等方面。
小红书发布 SWE-Bench Mobile:当 AI Agent 面对亿级用户 App 代码库,最高通过率仅12%?
小红书联合多科研机构发布 SWE-Bench Mobile,它是首个还原‘端到端’开发流程的基准,以小红书 App 实际任务为核心。评测显示,AI Agent 在移动端开发能力上限低,架构设计比模型本身重要,简单提示策略效果更好。
华师大智金院孵化金融原生基模Mint-Agent:超越GPT-5.6与Claude Opus 4.8,商业订单已超亿元
华东师大智金院团队孵化的金融原生基模 Mint - Agent 发布,在 FinanceAgentBench v2 上表现超 GPT - 5.6 - Sol 与 Claude Opus 4.8,单题推理成本低,商业订单超亿元,进入规模化金融场景验证阶段。
Claude Code越更越废?!大厂AI主管公开怒喷思考深度暴跌,官方回应更被怼爆 :菜成AI“玩具”
开发者 Stella Laurenzo 分析称,Claude Code 在 2 月更新后,思考深度下降 67%、算力消耗大增,无法用于复杂工程任务。她提出改进建议,开发者对此认同,负责人回应遭反驳,部分人考虑转用 Codex。
推出4个月就狂赚3亿?!百万用户应用CTO弃Copilot转Claude Code:200美元拯救我的137个应用
Anthropic 公司推出的 AI 编码助手 Claude Code 推出 4 个月吸引 11.5 万开发者,单周处理 1.95 亿行代码,年化收入预估达 1.3 亿美元。开发者认为它优势明显,Soham 级别的生产力,还分享使用技巧。
全靠Claude Code 10天赶工上线,Cowork 删用户11G文件不含糊!核心研发:长时间打磨再发布很难成功
Anthropic发布的Claude Cowork研究预览版问题频出,如删用户文件、易受文件窃取攻击等。与Claude Code相比,它交互繁琐、效率滞后。不过其核心研发认为长时间打磨再发布难成功,未来将以用户反馈迭代。
Claude Design开源版本来了!支持超过 71 套最顶级的品牌设计系统,可以直接复刻,构建属于你的顶级网页!
Anthropic的Claude Design闭源,Open Design是其开源替代品。它支持超71套顶级品牌设计系统,可直接复刻构建网页,还支持多种coding agent,有完整提问机制,确保产出符合需求。
“商业的HTTP”来了:谷歌CEO劈柴官宣 UCP,Agent 直接“剁手”下单,将倒逼淘宝京东“拆家式重构”?
谷歌CEO近日宣布开放标准UCP,目标是让Agent在线购物,将购物流程拆解成可复用组件。风险投资人认为其想成商业领域的“HTTP”,不少行业人士看好。它还能与其他协议协同,发布首日吸引众多伙伴。
Agentic RL训练:它不是单一 RL 算 法,而是一整套环境建模、学习信号、异步数据流、策略优化和基础设施的协同系统
文章指出Agentic RL训练不是单一算法,而是协同系统。它与传统RL不同,有四个训练变化。理解它要围绕三个不变量,还从环境建模等八个方面阐述,强调其竞争在于环境、信号、分布与系统的协同闭环。
【实测&解读】全球首个手机通用Agent——AutoGLM 2.0发布!我喝到了AI为我点的第一杯咖啡~
智谱更新的AutoGLM 2.0是全球首个手机通用Agent,适配苹果和安卓手机,无需交出手机使用权。它配备云手机和云电脑,由GLM - 4.5和GLM - 4.5V驱动,能完成点咖啡等多场景任务,因风险控制付款需人确认。