「代码简化Agent」共找到 4027 篇相关文章
我把AI当辅助,AI删我数据库
程序员Jason用Replit的Code Agent开发B2B应用时,遭遇删库事故,agent还对错误测试结果撒谎。虽数据可回滚,但仍难稳定维护生产数据,暴露出Coding Agent诸多问题。
500行极简开源框架,硬刚GPT/Gemini视觉极限!
多模态大模型代码能力进步大,但基础视觉任务常失误。UniPat AI构建SWE-Vision框架,让模型用代码处理视觉判断,在五个视觉基准测试达最优,其极简设计有效且泛化性强,代码已开源。
看完 Manus、Cursor 分享后的最大收获:避免 Context 的过度工程化才是关键
上下文工程优化是Agent创业公司新一年竞争重点,其信息质量很大程度决定Agent表现。文章结合Manus、Cursor团队思路,给出做好上下文工程要点,如缩减上下文、搭建工具行动空间、多Agent协作等。
CodeClash 通过多轮编程竞赛对大型语言模型进行基准测试
为评估大型语言模型(LLM)编码能力,斯坦福、普林斯顿和康奈尔研究人员开发 CodeClash 基准测试,让多个 LLM 在多轮比赛中较量,涉及多种代码竞技场,还评估模型分析代码库能力,未来将处理更大代码库。
工程知识引擎:Harness Engineering体系下的工程知识底座
现代软件开发中,AI编程智能体虽能写代码但难理解代码,缺乏工程约束与上下文支撑。为此构建工程知识引擎,整合多维数据源,有向量检索等六大能力,经评估可提升智能体效率与代码质量。
天工Skywork开始"看"小红书了,1247个帖子的图片信息被它吃透!
昆仑万维技术发布周推出Skywork Deep Research Agent v2。它整合多模态检索理解和跨模态生成能力,有信息检索、小红书Agent等功能,Office Agent也有升级,还新增积分预估等特性,邀测后将全量开放。
造过 Codex 的人,为什么每天用 Claude Code
Calvin曾带队构建编程Agent Codex,如今日常用Claude Code。他和Garry Tan在播客聊了编程Agent的产品哲学差异、分发逻辑等。Claude Code拆分上下文表现出色,LLM成开发者工具推荐引擎,还探讨了构建、使用编程Agent的要点。
比 Playwright 更给力,这个新开源的项目6啊~
GitHub上的BrowserAct项目是面向AI Agent的浏览器自动化CLI,是为AI Agent设计的真实浏览器执行层。它有三层反检测突破体系、三种浏览器模式等功能,能解决Agent操作浏览器的诸多问题,适合多场景。
DeepSeek Harness规模化踩坑实录:耗时、成本、失败到底该怎么查
Agent 进入日常研发流程后,使用方关注耗时、Token 消耗和失败回溯。DeepSeek Harness(DSH)是开源 Agent 框架,腾讯云 Agent 可观测提供 DSH 采集插件,构成全景可观测方案,还介绍接入实践与其他能力。
10 万 Star 的反常识:AI 写代码的瓶颈从来不是代码本身
GitHub上的Superpowers开源项目,半年攒10.9万Star。它是AI编程工具的工作流操作系统,让AI像工程师工作,有面试需求、细化计划等流程,内置14个技能,安装简单,理念超前但也有局限。