「编程工作流」共找到 1419 篇相关文章
BeyondSWE:AI编程80分是真的强,还是考卷太简单?
前沿模型在SWE - bench Verified测试中得分超80%,但该测试像开卷填空。中国人民大学提出BeyondSWE重新设计评测,规模是前者18倍,模型得分全跌破45%。还提出SearchSWE框架,结果显示搜索与编码能力融合待提升。
CodeClash 通过多轮编程竞赛对大型语言模型进行基准测试
为评估大型语言模型(LLM)编码能力,斯坦福、普林斯顿和康奈尔研究人员开发 CodeClash 基准测试,让多个 LLM 在多轮比赛中较量,涉及多种代码竞技场,还评估模型分析代码库能力,未来将处理更大代码库。
谷歌开源的 Gemini CLI 扩展助力开发者构建定制化人工智能工作流
谷歌发布开源的 Gemini CLI 扩展框架,引入‘剧本’概念,可让 AI 与外部工具交互。框架增强了 Gemini CLI 功能,支持多组件。谷歌构建开放生态,还为开发者提供模板和指南,其在 AI 驱动 CLI 领域有独特优势。
实测新版LiblibAI:终于把模型、生图、工作流塞进一个碗了
本文实测新版LiblibAI,它上线多个模型,添加视频特效玩法。从“找模型”网站变为“AIGC流水线”平台,界面风格转变。虽有亮点,但也存在出图慢、模型惊喜感弱、页面卡顿等问题。
ACP 协议 + 多 AI 编程智能体:企业研发的新生产力平台
文章围绕 ACP 协议展开,介绍其概念、工作原理及在 AutoDev 的集成实践。还提及 ACP 生态、多 Agent 协作实践,如 Augment Intent、Google Antigravity。最后阐述企业级 AI 平台治理体系,包括 MCP、ACP、A2A 三层协议协同价值。
Claude封锁中国,腾讯带着国产AI编程工具CodeBuddy来了
Claude封锁中国背景下,国产代码模型加速发力。腾讯CodeBuddy上线,其IDE和CLI有新特性。InfoQ采访团队,探讨定位、技术等思考,国产模型与工具、生态形成“模型—工具—生态”链路。
两周反转:Anthropic「闪电」夺回被Cursor挖走的核心编程大将
本月初 Anthropic Claude Code 两位负责人被 Cursor 开发商挖走,两周后又被聘回。Anthropic 虽烧钱但赚钱能力变强,投资人愿超千亿美元估值投资。Claude Code 增长快,而 Cursor 更新引不满,用户外流。
技术思辨|AI Coding:经验壁垒正在失效,工具进化重塑编程
AI飞速发展,AI Coding对传统研发模式冲击大。文章总结5个变化趋势,如专业性转移升级、效率体现为高质量专注等,还探讨AI时代开发者核心技能及经验价值,指出变革带来挑战与机遇。
AI 编程越来越厉害了,我要怎么提升自己的系统架构能力?
文章指出 AI 写代码能力提升,对程序员系统架构能力要求更高且难被替代。介绍系统设计概念,分析做系统设计的难点,给出新人提升系统设计能力的方法,还说明 AI 可辅助提升该能力。
Vibe Coding撞墙了?换个思路治好AI编程的「局部失忆」
Vibe Coding虽降低开发门槛,但Coding Agent处理复杂任务易失控。当前Agent缺乏工程状态层隔离控制,Valkor等联合开源loom,它将交付拆解成状态链,过滤噪音,为大模型落地提供状态基建。