「AI代码评审」共找到 10465 篇相关文章

算法论文8

GAIR Paper 107|高校联合腾讯发布 GameCraft-Bench:AI已能端到端开发游戏,Claude Opus 四成达到可玩水平

香港中文大学(深圳)等高校联合腾讯发布 GameCraft-Bench,旨在构建基于真实游戏引擎、产物完整可运行且能验证的 AI 游戏生成评测基准,解决现有基准难衡量端到端可玩性的问题,测试显示前沿模型在游戏生成上仍薄弱。

AI科技评论
新闻资讯8

发春节红包的大厂被约谈;百度O计划曝光,文心助手MAU增4倍;影石CEO回应年会送出5套房|AI周报

本周AI行业热点不断,大厂春节红包促销被约谈,百度文心助手MAU猛增4倍,影石年会豪送5套房。还有模型更新引吐槽、谷歌发债、迪士尼侵权指控等事件,也有新模型发布及企业应用新进展。

AI前线
开源动态8

一个只有70行的文件,凭什么拿下GitHub 10万星?

GitHub上‘andrej - karpathy - skills’项目爆火,核心是不到70行的CLAUDE.md文件,给出AI编程助手行为准则。其火的原因有解决痛点、名人背书等,价值在于证明‘上下文工程’重要。

AI Reading Hub
推荐文章7

大厂的AI不限量补贴终会结束!Hermes Agent作者:开源框架真正的狠招是把Claude对Anthropic的忠诚抢过来

科技创作者 Peter Yang 对话 Hermes Agent 作者之一 Karan Malhotra,探讨 Hermes Agent 与其他产品的差异、模型谄媚问题、开源意义等。Karan 指出其独特自我改进系统与专注用户需求特点,还提及让模型更贴合用户的方法。

AI科技大本营
产品应用8

马斯克挖不动的清华学霸,一年造出 “反内卷 AI”!0.27B参数硬刚思维链模型,推理完爆o3-mini-high

新加坡Sapient Intelligence推出小参数AI模型HRM,能解决复杂推理难题。它受大脑启发,提出“隐性推理”路径,准确率碾压先进思维链模型,推理能力超越o3 - mini - high,经济性突出,任务效率可百倍提升。

AI前线
算法论文8

年度AI论文!全球三大顶尖模型的防蒸馏机制全面告破:小模型“套出”大模型隐藏思维链,Kimi-K3重现概率异常

这篇论文指出三大前沿AI模型厂商API有密码学旁路漏洞,攻击者用轻量级模型就能恢复大模型隐藏思维链数据。还揭示部分模型训练或借鉴大模型思维链,此漏洞也致企业数据隐私安全问题。

AI前线
产品应用7

从被吐槽“套壳中国大模型”到自研封神!首次揭秘Cursor背后极速代码Agent如何对标GPT5.1 Codex,生成效率提4倍

10月29日,Cursor 2.0发布Composer大模型,效率约为其他模型四倍。开发者分享其成极速代码Agent方法,如强化学习、平衡训练与推理负载等,还提及未来方向及研发反思。

InfoQ
开源动态8

9.3K Star!开源Claude Code配置神器,100+模板开箱即用!

2025年AI编程浪潮中,Claude Code强大却配置难。开源项目Claude Code Templates解决痛点,提供100+现成模板,npx一键安装、可视化界面操作,无需敲配置代码,快速部署。

开源星探
新闻资讯7

arXiv脱离康奈尔,正式单飞

arXiv 7 月 1 日脱离康奈尔大学,以独立非营利组织 arXiv, Inc. 开启新篇章。功能暂不变,新架构由董事会治理。独立因财务、体制和 AI 压力,承诺免费但未明确是否引入付费功能。

机器之心
开源动态7

暴涨2.6万星!5000+专属技能让OpenClaw真正落地,手把手带你起飞。

OpenClaw项目已获20多万星,很多人不会用其技能。本着零代码原则教大家用好Skill,还推荐爆火的5000多个技能库。介绍了使用方式,强调描述需求要清晰。

开源AI项目落地