代码智能体」共找到 4773 篇相关文章

算法论文8

代码Agent的苦涩教训!首次拆解上下文检索,直指自动化软件瓶颈

ContextBench首次从「过程」评测代码智能体,揭示当前模型多读少用、被关键词误导等深层问题。它基于真实问题修复任务,由专家标注「黄金上下文」,用多指标评估。研究显示,复杂架构未必效果好,模型重召回轻精确等。

新智元
新闻资讯8

Claude Code 的创始人揭秘工作流程:开 5 个智能“玩编程游戏”,不看的程序员就落后了?

Anthropic公司Claude Code创始人Boris Cherny在社交平台分享工作流程,引发行业关注。他并行运行5个Claude智能编程,用最大最慢模型Opus 4.5,还解决AI“健忘症”,实现重复性任务自动化。

InfoQ
开源动态8

模型即智能,Kimi K2 Thinking多项评估超越顶尖闭源模型,300轮工具调用不疲倦

月之暗面发布Kimi K2 Thinking,它是Kimi迄今最强开源思考模型,基于模型即智能理念训练,可自主连续工具调用与多轮思考,多项评估超顶尖闭源模型,还实现原生INT4量化,提升生成速度。

AIGC开放社区
8

《AI Agent智能技术发展报告》正式发布 | 中科算网算泥社区

1月13日,中科算网算泥社区主编、中国工业互联网研究院参编的《AI Agent智能技术发展报告》发布。报告梳理了AI Agent技术进展、产业格局等,对其进行精准“再定义”,介绍发展阶段、2025年核心突破、产业生态等内容。

AIGC开放社区
推荐文章8

产品经理必读:AI智能架构指南——为什么能力强不等于用户爱用?

文章为产品经理打造AI智能架构指南,以客服智能为例,阐述四个架构层面决策,分析主流架构方法优劣,还指出构建智能要注重信任策略,第二部分将探讨自主性决策和治理问题。

宝玉AI
产品应用8

工程知识引擎:Harness Engineering系下的工程知识底座

现代软件开发中,AI编程智能虽能写代码但难理解代码,缺乏工程约束与上下文支撑。为此构建工程知识引擎,整合多维数据源,有向量检索等六大能力,经评估可提升智能效率与代码质量。

阿里云开发者
算法论文8

浙大&港理工等提出InfiGUI-R1:利用强化学习,让GUI智能学会规划任务、反思错误

多模态大模型驱动的GUI智能有潜力,但现有智能面对复杂任务力不从心。浙大等机构提出InfiGUI-R1及Actor2Reasoner框架,通过两阶段训练提升智能能力,InfiGUI-R1-3B在多基准测试中性能卓越,为GUI自动化工具开辟新道路。

机器之心
算法论文8

303页年度最佳AI Code综述:阿里、字节、快手30家顶级机构出品

分享303页《从代码基础模型到智能与应用:代码智能实践指南》,由近30家顶尖机构出品。介绍2021 - 2025年代码大型语言模型发展,分析通用与代码专用LLM能力,阐明研究 - 实践差距,还开展实验。

PaperAgent
开源动态7

BettaFish微舆:一个多智能舆情分析系统

BettaFish微舆可依自然语言需求抓取分析30多个主流社交媒生成舆情报告。它将任务拆解给不同智能,系统架构清晰,最终整合生成带时间线分析的HTML报告。项目在GitHub开源且登顶趋势榜第一。

AI工程化
开源动态8

UniPat AI开源SWE-Vision:五百行代码打造SOTA视觉智能

多模态大模型代码能力进步大,但基础视觉任务常失误。UniPat AI开源SWE-Vision框架,让模型用Python代码处理视觉判断。它极简设计,在五个视觉基准测试达最优,提升前沿模型视觉表现。

机器之心