编程应用」共找到 3100 篇相关文章

开源动态8

开源即登榜!登顶全球前十AI编程智能体,UCL初创团队开源Prometheus

UCL初创团队EuniAI开源AI软件智能体Prometheus,在SWE - bench Verified上Pass@1达71.2%,成绩入官方主榜。它有图结构推理设计,能理解代码,成本低,官网有Demo展示其工程化能力。

新智元
产品应用8

Claude 4发布!AI编程新基准、连续编码7小时,混合模型、上下文能力大突破

今天凌晨Anthropic开发者大会发布Claude 4,含Claude Opus 4和Claude Sonnet 4。前者是顶尖编码模型,后者是Sonnet 3.7重大升级。还发布系列产品,定价不变,已上线Amazon Bedrock。

Founder Park
新闻资讯7

57.6万代码撕碎AI编程神话,20%「幽灵包」暗藏漏洞!苹果、微软已中招

最新研究用57.6万个代码样本揭示,超20%代码依赖的是不存在的软件包,为供应链攻击创造机会。Meta和微软虽看好AI写代码,但AI生成代码或成安全灾难,开发者需仔细检查。

新智元
新闻资讯8

谷歌超强 AI Agent 登场:攻克 300 年数学难题、改进芯片设计!编程迎来 AlphaGo 时刻?

谷歌 DeepMind 推出由 Gemini 驱动的 AI 智能体 AlphaEvolve,能自我进化解题。它破数学界 53 年纪录,解决 50 多个数学难题,还应用于谷歌数据中心、芯片设计等,提升效率。其进化方法独特,还能减少幻觉。

AI前线
开源动态7

Agent 基建不是设计出来的,是被 Kimi K3 和一堆应用公司卷出来的

文章以 Kimi K3 模型及相关 agent 产品为例,讲述 TiDB 作为基建服务商,满足 AI 团队需求形成 Agent Stack。还指出 Agent 时代基建难题、数据库使用变化,以及创业团队做 Agent 业务的三个判断。

Founder Park
算法论文8

32B逆袭GPT-5.2:首个端到端GPU编程智能体框架StitchCUDA问世

现有LLM自动化CUDA方法难处理端到端GPU程序,StitchCUDA提出多智能体框架+基于Rubric Reward的Agentic RL方案,分解任务、优化训练,在实验中成功率和加速比远超其他方法,解决Reward Hacking问题。

机器之心
开源动态8

阿里开源Qwen3-Coder-Next,80B参数仅激活3B的MoE顶尖编程助手

阿里开源小型MoE代码模型Qwen3 - Coder - Next,总参数量800亿但仅激活30亿参数,在代码生成等任务表现出色。团队构建训练技术栈解决数据匮乏,模型训练分阶段,多领域专家模型能力整合,基准测试性能强劲。

AIGC开放社区
开源动态8

NeurIPS 2025 | Code Graph Model:重塑代码大模型架构,利用“代码图”突破仓库级编程瓶颈

在 NeurIPS 2025 上,蚂蚁全模态代码算法团队展示「Code Graph Model (CGM)」,它将代码库图结构注入 LLM 底层注意力机制,打破业界刻板印象,在权威榜单上表现出色。文章解析其架构、训练策略和配套框架。

AINLPer
算法论文8

用「进化+压力测试」自动生成的竞赛级编程题,各家大模型谁更hold住?

北京大学与通用人工智能研究院联合提出 UniCode 框架,构建进化式评测系统,能自动生成高质量算法题目与抗污染测试用例。通过对 19 个前沿大模型测试,展现高挑战性与强判别力,为代码能力评估开辟新路径。

机器之心
开源动态8

英伟达4段简短提示词,IOI夺金!开源模型也能征服最难编程竞赛

英伟达研究者提出GenCluster框架提升开源LLM解题能力,让开源模型gpt - oss - 120b在IOI 2025获金牌级别高分。它执行‘海选+筛选+比拼+提交’流程,优势明显,标志开源AI里程碑式突破。

新智元