「Open Code Review」共找到 981 篇相关文章
今天,被GLM-5的Agentic Coding能力惊艳到了
上月底Anthropic报告揭示编程趋势转变,月初Claude Opus 4.6与GPT - 5.3 Codex发布印证。作者深度测试GLM - 5,经两项实测挑战,发现其在复杂系统任务表现超预期,有‘系统架构师’思维。
小白 Vibe Coding 发行全平台&可变现应用指南
文章以作者用 Youware 开发 AI 日记软件 Vibe Diary 为例,介绍 Youware 的 Youbase 和 Coview 能力,展示其构建全平台可变现应用的强大,包括后端服务、数据库、AI 功能、UI 修改等,还提及 PWA 打包和变现集成。
我们对 Coding Agent 的评测,可能搞错了方向
用户对 Agent 不满常因它「做得不好」,不遵循指令和规范。当前主流评测体系以结果为导向,与真实场景错位。MiniMax 开源 OctoCodingBench 评测集,结果显示模型过程规范遵循不足,未来训练需引入过程监督。
Vibe Coding成AI主战场:22个明星玩家值得关注
AI产品下半场,氛围编程成赛道焦点。国外大厂推新,国内大厂双轮发力。量子位2025Q3 AI 100榜单显示,开发层产品多增强Agent功能,介绍了旗舰100和创新100中的明星产品。
Open AI 新模型在 IMO 2025 上获得金牌!
OpenAI新模型在2025年国际数学奥林匹克(IMO)中达金牌水平,测试时不借助工具、不连互联网,且不太可能存在数据污染。该模型解决6题中的5题,非GPT - 5,近期也不发布。
不止修bug:Agentic Coding评测走向复杂feature交付新阶段
中国科学院自动化研究所联合华为提出 FeatureBench,构建端到端基础设施并开源。它从单元测试出发构造评测任务,引入多种机制保障任务可执行、可验证,能有效区分模型能力,还提供易用的评测流程。
Sora 2 中国首测?Open AI 这次真成了!
OpenAI提前发布Sora 2模型,可克隆音色,支持多语言。还推出似AI版抖音的社交APP,免费生成视频。测试显示,它有世界知识,能多参生成、自动切镜头,在多方面表现出色,但版权限制严,部分一致性待提升。
DeepSeek正式开源Harness:它终于有了自己的Vibe Coding入口
今晚,DeepSeek 正式发布并开源 DeepSeek Harness(DSH)开发者预览版,它是一套 Agent 运行框架。此前 DeepSeek-V4-Pro 上线,二者结合,Harness 负责将模型能力组织成可工作的 Agent,使 DeepSeek 进入相关竞争。
Claude Code狂删80%提示词,Opus 5反手加回去了
Anthropic宣布删掉Opus 5等模型超80%系统提示词,因早期提示词规则多易冲突。但网友实测Opus 5比Opus 4.8提示词加长72%,新增内容用于约束模型主动行为。
从Vibe Coding到Harness—— 一套大仓AI工程化实战
这是腾讯后端微服务与前端微应用大仓的 Harness 实战分享。介绍了 TAB 工程背景、Harness 组成部分,阐述阶段划分、Agent 演进等,还提及人工关卡、门禁脚本等要点,总结了经验与限制。