「评估工程」共找到 1392 篇相关文章
2026年了,我们还在用爱迪生试灯丝的方式评估World Model
文章围绕World model展开深度讨论,界定其概念,分析生成派、JEPA派、空间智能派三条技术路线,指出评估比LLM难,提及游戏化benchmark可能是破局点,还强调具身进展由数据驱动,Ego - View或为泛化关键。
Pinterest 工程通过运行时感知分片将 Android CI 构建时间缩短了 36%
Pinterest 发布技术案例研究,介绍工程团队通过运行时感知的测试分片策略和内部测试平台,将 Android CI 构建时间缩短超 36%,还对比了其他公司提升 CI 性能的做法。
深度解读《AI 智能体的上下文工程》:构建高效 Agent 的七个宝贵教训
作者解读 Manus 团队文章,结合自身理解总结出构建高效 Agent 的 7 个关键点,如依赖上下文工程、提升 Prompt 缓存命中率等,还给出总结与核心启示,对 Agent 开发有借鉴意义。
全国首部AI智能体应用评估标准,现公开征集起草单位和个人!
2025年成AI智能体元年,市场规模爆发式增长,但企业部署面临‘效能黑箱’。智合标准中心发起《企业级AI智能体应用效能评估规范》团体标准起草,现公开征集起草单位和个人。
撕开Claude Code真相:让它好用的98.4%,是工程不是AI
X用户推文曝光Claude Code项目模板,实则是公开范式。研究显示Claude Code 98.4%是工程基建。OpenAI等团队已将AI编程跑成生产线,普通开发者也能搭建入门版基建。
OpenAI 收购 A/B 测试新秀Statsig :印度裔创始人出任应用CTO,执掌 ChatGPT 产品工程
OpenAI宣布收购A/B测试巨头Statsig,其创始人Vijaye Raji将任应用部门CTO,负责ChatGPT等产品工程。Statsig为企业提供A/B测试等服务,收购将增强OpenAI实验能力。
讲透 Graph Engineering【2】:从画出一张 Graph,到真正把它工程化。
本文探讨 Graph Engineering 在工程落地的关键问题,介绍 Graph 几种基础协作模式,如顺序协作、动态分流等,还提及从 Graph 到 Engineering 的关注点、开发的主流框架与趋势,最后提醒别为了 Graph 而 Graph。
这次,Agentic AI工程化的底牌全被抖出来了 | QCon北京2026
QCon全球软件开发大会·2026北京站4月举办,以‘Agentic AI时代的软件工程重塑’为主题。大会有主题演讲、专题演讲,汇聚一线专家探讨AI工程化等多方面内容,还关注AI向物理世界延伸,讲师分享实践经验。
为什么你的 AI Coding 账单越涨越快?十个节约 Token 的工程办法。
文章指出今年大模型Token账单涨得快,尤其AI编程重度用户。从工程角度总结降低Token消耗的方法,如上下文清场、代码导航等,还分析AI Coding的Token变贵原因及各方法适用边界。
提示工程实战指南:从Zero-Shot到Graph Prompting,7大核心技术全解析
随着大型语言模型发展,提示工程成关键技能。文章介绍零样本提示、少样本提示等七种提示优化模式,分析适用场景、优缺点,还给出示例,最后总结各技术适用场景及最佳实践。