代码能力评测」共找到 4821 篇相关文章

7

Gemini 3,是谢尔盖・布林「骂」出来的?

ChatGPT 问世后谷歌反应迟缓,创始人谢尔盖・布林回归,亲自写代码,推动 Google Brain 与 DeepMind 合并。他还因 Gemini 被禁止写代码在公司大吵。谷歌推出 Gemini 3 等,坐稳 AI 领域王座,给 OpenAI 带来压力。

机器之心
推荐文章8

她如何把“系统2”带给了大模型 |对话微软亚洲研究院张丽

本文是量子位对微软亚洲研究院首席研究员张丽的访谈。张丽团队在2023年开始探索大模型深度推理能力,2025年1月发布rStar - Math,用蒙特卡洛搜索算法让7B模型实现o1级数学推理能力,引发广泛讨论。

量子位
8

“10周的工作量,AI只用4天!”Anthropic发布会全程实录:你引以为傲的复杂工程,在模型眼里只是个玩具

Anthropic举办‘Code w/ Claude’开发者大会,指出AI模型能力呈‘指数级’增长,多数企业开发模式却停留在‘线性’阶段。大会祭出三大杀手锏,包括更强底层模型、Claude Platform代理编排能力和Claude Code桌面端。

AI科技大本营
新闻资讯8

从「自我进化」到「DAA」,百度给出 Agent 时代系统答案

2026 年 AI 行业发展微妙,模型能力增强但转化为生产力的企业不多。Create 2026 上百度给出两层答案,构建系统能力,提出 DAA 度量 AI。这是过去三年判断的收束,将非共识整合成面向 Agent 时代的方法论。

AI前线
新闻资讯7

Meta 将移动端消息基础设施从 C 迁移到 Rust

Meta正在用Rust逐步重写移动端消息基础设施,替换老旧C代码。内存安全、开发者幸福感和长期可维护性是迁移动机。编译核心库用于多应用,虽Rust学习曲线陡,但团队用多种方式克服,还改进工具链。

InfoQ
开源动态8

Qwen全面升级非思考模型,3B激活、256K长文、性能直逼GPT-4o

Qwen全新非思考模型Qwen3-30B-A3B-Instruct-2507上线,仅激活3B参数,性能媲美顶尖闭源模型。相比前代,推理、对齐和长文本处理能力大幅提升,在通用能力上也全面进步,适合复杂人机交互应用。

量子位
开源动态8

迈向AI4S 2.0,上海AI实验室开源书生万亿科学大模型Intern-S1-Pro

2月4日上海人工智能实验室开源万亿参数科学多模态大模型Intern - S1 - Pro,为AI4S迈向2.0提供开源基座。其核心科学能力跃升,底层架构创新,科学与通用能力协同发展,还构建了‘算力 - 算法’一体化基座,推动科研范式革命。

OpenMMLab
新闻资讯8

性能真的不重要了吗?Jeff Dean给出反常答案

Google传奇工程师Jeff Dean更新文档《Performance Hints》,指出性能不是最后调出来的,而是写代码初始就注定的。很多人因对‘慢’无感、忽视性能,导致代码低效,顶级工程师则有‘物理地图’,能避开高成本路径。

新智元
产品应用7

一个销售数据分析机器人的诞生:看 Dify 如何在 DMS 助力下实现自动化闭环

Dify是低代码AI应用开发平台,但在企业级落地有代码执行和自动化调度瓶颈。本文介绍用“Dify + DMS Notebook + DMS Airflow”架构,以销售数据分析机器人为例,展示构建可调度、可扩展、可运维Agent系统的方法。

阿里云开发者
开源动态7

卷疯了!这个清华系Agent框架开源后迅速斩获1.9k stars,还要“消灭”Prompt?

随着大模型能力突破,Agent 从概念走向应用,各类框架不断涌现。清华系团队发布开源框架 Cooragent,获 1.9k stars。创始人王政分享 Agent 发展洞察,指出大模型能力提升推动 Agent 商业化,还探讨 MCP、框架等多方面问题。

AI前线