「代码能力评测」共找到 4821 篇相关文章
AI 提效了,老板觉得自己又行了:可代码行数和 Token 排名,真该拿来裁人吗?
文章探讨AI提效下的行业现状。开发者节奏加快,企业收紧人力。不同行业提效有别,互联网显著,金融审慎。还谈及效率悖论、裁员依据、生产力衡量及成本管控,指出提效应用于承接项目而非裁员。
业务逻辑的“坍塌”:当应用层只剩下胶水代码,在 AI Agent 时代,我们该构建什么
作者梳理从“怀疑AI”到“理解并驾驭AI”的心路,探讨LLM不确定性、AI开发概念,手搓Agent示例介绍开发关键点,分析LangChain价值,思考混合架构,还从性能视角看LLM,回顾其关键跃迁。
OpenClaw创始人:80%的应用会消失,花哨的AI工作流只会生产垃圾,工程思维才是超能力
OpenClaw创始人Peter Steinberger表示,OpenClaw这类AI助理将取代手机上80%的应用。他分享OpenClaw诞生过程,其能远程修复Bug等。他还批判花哨AI工作流,认为人类品味不可或缺,建议学习AI要去玩。
一次代码提交=250万美元!xAI被开除工程师大爆料,揭秘马斯克“人类模拟器”秘密项目
xAI技术成员Sulaiman Ghori在播客披露公司内幕被开除。他透露了“人类模拟器”项目、算力工厂建造细节、内部工作文化等敏感信息,还描绘了充满马斯克风格的xAI工作画像。
代码为刃 创意为甲,探索国产AI应用新路径 ——“算网杯”2025 AIGC开发者大赛圆满落幕
1月17日,“算网杯”2025 AIGC开发者大赛决赛在中国科大苏州高等研究院落幕。大赛受业界关注,吸引500余名开发者。以“探索国产AI应用新路径”为导向,成果丰富,发掘了人才与项目,为产业注入动能。
让两个大模型「在线吵架」,他们跑通了全网95%科研代码|深势发布Deploy-Master
科学计算领域开源软件多,但多数无法直接运行,制约可用性。Deploy - Master 针对此开发,通过搜索筛选工具、双模型博弈构建,将部署成功率提至 95%以上,为 Agentic Science 提供行动基座。
华为开源7B多模态模型,视觉定位和OCR能力出色,你的昇腾端侧“新甜点”来了
华为推出开源多模态模型openPangu-VL-7B,适配昇腾端侧。它推理性能性价比高,在多核心任务表现突出,技术报告还披露核心技术细节,为昇腾使用者带来新选择,丰富昇腾生态。
自回归因果注意力也能并行解码?上交联合UCSD突破LLM推理瓶颈,模型代码全开源
大语言模型推理速度是应用瓶颈,传统方法各有弊端。上交和UCSD团队提出Jacobi Forcing方案,无需重构架构,将AR模型转为并行解码器,提速显著且质量损失小,核心优势多,技术路线全链路优化,实测表现优。
百度秒哒负责人朱广翔:AI开发革命的终局,是让创意本身成为唯一的“代码”
百度秒哒负责人朱广翔指出,传统应用开发模式受“不可能三角”所困,而秒哒旨在破局。他还分享了AI时代生产力公式,强调多智能体协作关键,认为AI开发终极目标是让人聚焦创意,且不会取代产品经理和程序员。
GPT-5惨遭零分打脸,顶级AI全军覆没!奥特曼AI博士级能力神话破灭
FormulaOne硬核测试让顶级大模型现原形,其题目分三关,基础题AI还行,进阶题和最深层题表现惨不忍睹。该测试由AAI公司出品,问题具商业价值,反映出当前AI离真正专家还有距离。