传统编程」共找到 2112 篇相关文章

算法论文7

BeyondSWE:AI编程80分是真的强,还是考卷太简单?

前沿模型在SWE - bench Verified测试中得分超80%,但该测试像开卷填空。中国人民大学提出BeyondSWE重新设计评测,规模是前者18倍,模型得分全跌破45%。还提出SearchSWE框架,结果显示搜索与编码能力融合待提升。

PaperAgent
产品应用8

多 AI 协同 + SDD 编程实践:一个 AI 全流程交付实录

2025 年以来 AI Coding 技术发展迅速,但在复杂业务场景中存在诸多问题。文章基于 SDD 范式,构建由 Claude Code、CodeX 与 Gemini 协同驱动的工作流,介绍 SDD 理念、技术选型,详述多模型协作机制、工作流程与保障机制,分享实践步骤。

阿里云开发者
算法论文8

谷歌发布智能体Scaling Law:180组实验打破传统炼金术

谷歌新论文通过180组实验找到智能体的Scaling Law(定量扩展原则),在四个基准测试评估,推导预测模型,实验结果颠覆直觉,还量化阻碍因素,发现不同模型协作性格,为智能体部署决策提供支撑。

机器之心
算法论文7

CodeClash 通过多轮编程竞赛对大型语言模型进行基准测试

为评估大型语言模型(LLM)编码能力,斯坦福、普林斯顿和康奈尔研究人员开发 CodeClash 基准测试,让多个 LLM 在多轮比赛中较量,涉及多种代码竞技场,还评估模型分析代码库能力,未来将处理更大代码库。

InfoQ
新闻资讯8

OpenAI深夜发布ChatGPT Study:免费AI家教,彻底颠覆传统教育

今天凌晨1点,OpenAI发布ChatGPT Study学习模式,面向教育领域,有交互式提示等四种方法,能解读难题思路,免费版也有此模式。其底层有自定义系统指令,特色功能实用,不少内测用户已用它解决学习难题。

AIGC开放社区
产品应用8

巧妙!一个传统技术让国产视觉基础模型直接上大分

格灵深瞳的Glint - MVT视觉基础模型表现出色,线性探测准确率高于CLIP等,下游任务效果佳。其引入间隔Softmax损失函数,结合虚拟类别构造等优化方案提升性能,团队专注视觉研发,务实开放。

量子位
推荐文章8

ACP 协议 + 多 AI 编程智能体:企业研发的新生产力平台

文章围绕 ACP 协议展开,介绍其概念、工作原理及在 AutoDev 的集成实践。还提及 ACP 生态、多 Agent 协作实践,如 Augment Intent、Google Antigravity。最后阐述企业级 AI 平台治理体系,包括 MCP、ACP、A2A 三层协议协同价值。

phodal
产品应用8

Claude封锁中国,腾讯带着国产AI编程工具CodeBuddy来了

Claude封锁中国背景下,国产代码模型加速发力。腾讯CodeBuddy上线,其IDE和CLI有新特性。InfoQ采访团队,探讨定位、技术等思考,国产模型与工具、生态形成“模型—工具—生态”链路。

InfoQ
产品应用8

UCSD首个智能体浏览器发布!多页面设计,颠覆传统交互

加州大学圣地亚哥分校推出Orca浏览器,把网页视为可塑材料,浏览器变为可塑空间。用户能在无限画布中浏览、管理网页,调度智能体完成任务,还可进行大规模查看、管理等操作,项目将开源。

新智元
新闻资讯7

两周反转:Anthropic「闪电」夺回被Cursor挖走的核心编程大将

本月初 Anthropic Claude Code 两位负责人被 Cursor 开发商挖走,两周后又被聘回。Anthropic 虽烧钱但赚钱能力变强,投资人愿超千亿美元估值投资。Claude Code 增长快,而 Cursor 更新引不满,用户外流。

机器之心