代码审查员」共找到 1642 篇相关文章

8

谷歌杀疯!百万token神器免费开源,Claude和Codex都顶不住了?

谷歌开源免费AI编程工具Gemini CLI,权限拉满,有百万token上下文、千次调用额度,打通VS Code与终端。它与OpenAI、Anthropic竞争,功能不止写代码,还支持多通用任务,谷歌这次来真的!

新智元
算法论文8

0%完成率!Claude、GPT、Gemini 全灭,SWE-Bench作者新作把AI圈干沉默了

SWE - Bench创建者推出新benchmark ProgramBench,测试AI从零构建软件系统能力。结果一线模型完成率0%,暴露AI擅长局部代码生成,缺全局系统规划能力,引发对其评估方式的讨论。

机器之心
开源动态8

AI4S设计的新抗生素通过湿实验!双层思考+多目标优化,主动发现「代谢不稳」并加约束

SAGA是新AI,采用双层思考机制,能主动审视需求、优化目标函数。在抗生素、纳米抗体等5大领域湿实验中表现出色,结果获科学家肯定,相关代码已开源。

量子位
新闻资讯8

Gemini 3 Flash 发布,多、快、好、省,Coding 能力不输大哥Gemini 3 Pro

Google DeepMind 发布 Gemini 3 Flash,成本极低。它在多项测试表现出色,速度快、效率高,代码能力超 Gemini 3 Pro,获企业客户好评,今日起向全球开发者和普通用户推送。

AGI Hunt
算法论文8

AAAI 2026 | 北航、东京大学填补AI「语义鸿沟」,过程感知视频理解如何找到「状态」锚点?

北航陆峰教授团队联合东京大学,提出视频理解新框架 TSS,引入“状态”作视觉锚点,解决抽象文本指令与具象视频对齐难题,已被 AAAI 2026 接收,代码已开源。

机器之心
算法论文8

突破通用领域推理的瓶颈!清华NLP实验室强化学习新研究RLPR

现有基于可验证奖励的强化学习(RLVR)应用范围局限,清华自然语言处理实验室提出 RLPR 技术,通过 Prob - to - Reward 提高概率奖励质量,有领域无关等特点,相关代码等已开源。

机器之心
开源动态8

单目3DGS迎来突破:影石开源UniSHARP实现全相机适配

影石研究院发布单目新视角合成模型UniSHARP,可通过单次推理秒级获场景高斯点云,支持混合相机训练与免标定推理,适配所有相机。团队还构建数据集、设benchmark,代码等均已开源。

机器之心
产品应用7

阿里QwenLong-32B:1W+超长Token推理,知识密集型复杂文档高效推理

文章介绍阿里QwenLong - 32B在长文本推理的能力。长文本推理有训练效率低和优化不稳定问题,QWENLONG - L1通过强化学习等解决,还阐述其组件、训练步骤,并给出实战代码及相关链接。

CourseAI
产品应用7

10万智能体同场模拟,YuLan-OneSim带来真正的大社会实验

YuLan-OneSim是大语言模型驱动的社会模拟器,能模拟人类社会行为。它可零代码构建场景,有50个默认场景,具分布式架构,支持10万智能体同场模拟,还推出AI社会研究员,自动完成社会科学研究流程。

带你学AI
算法论文8

没想到,又一个Code Agents瓶颈,被美团&上交大彻底撕开了~

AI写代码能力提升,但打分方法僵化且成本高。上交大与美团论文提出新基准PRDBench,让AI出题人审核,还训练裁判PRDJudge,提升打分准确率与稳定性,促使AI学会‘看懂需求’。

PaperAgent