编程基准」共找到 1887 篇相关文章

新闻资讯8

OpenAI深夜放出GPT-5狙击谷歌!基准测试碾压前代模型,价格比Claude更便宜

北京时间8月8日凌晨,OpenAI推出GPT - 5,宣称其更智能、准确,幻觉率低。还推两款新模型,介绍了不同用户套餐。它在编程基准测试表现佳,健康领域能力突出,引发各界热议。

AI前线
新闻资讯8

马斯克首个编码模型上线,编程飙进Top5!这9位华人天团爆肝打造

xAI上线首个编码模型Grok Code Fast 1,速度快且性价比高,在编程基准测试中冲进前五。它全栈开发能力出色,背后核心团队华人学者占多半,xAI还给出提示词编写指南。

新智元
产品应用7

老黄亲自站台,英伟达编程神器!Cursor 2.0自研模型狂飙4倍

Cursor 2.0版本重大升级,发布自研编码模型Composer,速度是同等模型4倍。还重构IDE交互逻辑,支持多智能体模式,引入语音模式等。早期测试和开发者反馈其速度快,但智能程度与部分模型有差距。

新智元
开源动态8

3天狂揽23.1k星!把代码库变成知识图谱,AI编程成本降低35%

CodeGraph是开源本地代码知识图谱工具,提前为项目建索引,组织代码信息,让Agent直接查询。能减少token消耗与工具调用、提高响应速度,数据本地保存,还具备多语言支持等特点。

开源AI项目落地
新闻资讯7

盘点2025年全球宕机事件,还有不用AI写代码的公司吗?

2025年Cloudflare、AWS等轮番宕机,“连坐”半个互联网。AI编程全面普及,虽提高效率,但可能让宕机更易发生、难提前发现。宕机最爱发生在变更后,AI编程使改动频繁,还让人类理解系统比例下降。

开源AI项目落地
产品应用8

AI编程新王Claude 4,深夜震撼登基!连续编码7小时,开发者惊掉下巴

Anthropic发布全球最强编程模型Claude 4,含Opus 4和Sonnet 4。Opus 4是顶尖编码模型,Sonnet 4是Sonnet 3.7的重大升级。还发布系列产品,Claude 4定价与此前一致,部分用户可体验。

新智元
8

GPT-5实锤,悄悄上线代号「龙虾」!版本号曝光,实测编程惊人能改屎山代码

代号「龙虾」的神秘模型在WebDev Arena现身,网友猜测是GPT - 5,提前试用者称其编程能力惊人,能改屎山代码。多位用户表示其在代码生成等方面超越Claude,OpenAI或已秘密测试。

新智元
开源动态8

AI编程里程碑!谷歌AI自己写代码惊呆工程师,GPU内核算法反超人类21%

谷歌AlphaEvolve的开源实现OpenEvolve自学写代码,在苹果芯片上进化出比人类快21%的GPU核函数。它自主发现多项优化策略,经多维度测试,性能显著提升,开启「AI为AI编程」新时代。

新智元
新闻资讯7

没想到 2025 年 AI 领域爆发最猛烈的居然是它

文章指出2025年AI编程领域爆发式增长,一年营收从几亿到百亿美金。因其适合编程场景,能帮助各用户群体,未来渗透率有望大幅提升。还分析了发展猛的原因,且认为其潜力大,赛道仍在加速。

MacTalk
开源动态8

红杉中国推出 Agent 基准测试「xbench」,双轨评估体系,关注 AI 真实场景的效用

红杉中国开放AI和Agent基准测试工具「xbench」,采用双轨评估体系,构建多维度测评数据集。首期发布两个核心评估集并排名,提出垂类Agent评测方法论。该工具旨在解决现有评估问题,关注AI真实场景效用。

Founder Park