「Agent工程化」共找到 3736 篇相关文章
腾讯Kuikly框架鸿蒙版正式开源 —— 揭秘卓越性能适配之旅
腾讯将广泛使用的跨端开发框架Kuikly鸿蒙版正式开源,已接入多款业务。它有高性能、动态化特点,适配中解决渲染、文本性能等问题,还优化调试效率,发布Compose DSL Beta版。
优步针对微服务和大规模计算工作负载完成了大规模的 Kubernetes 迁移
优步成功将计算平台从 Apache Mesos 迁至 Kubernetes,覆盖多数据中心和云环境。工程团队详述迁移挑战、方案与教训。虽遇技术、文化难题,但迁移后运营效率等提升,为大公司提供借鉴。
2个月,20亿美元估值、硅谷7500万美元投资,Manus给中国AI创业者指了条什么路?
文章以Manus为例,分析其国内被质疑、海外却受青睐的原因。指出它虽无自有模型,但为巨头带来增量价值。还借量子隧穿效应说明其先发红利,最后探讨其挑战、目标及对“套壳”看法。
AI编码新神登基,藏师傅一手Claude 4实测
Claude 4低调发布,Anthropic称Claude Opus 4是全球最佳编码模型。发布内容含扩展思维、新模型能力等,还公布定价。Claude Opus 4编码和记忆能力强,实测表现出色,Claude Sonnet 4也有提升且免费。
字节开源DreamO,一个框架包揽多种图像定制需求
近期图像定制研究展示大规模生成模型潜力,但多数方法通用性有限。字节提出DreamO框架,支持多种图像定制任务,有特征路由约束机制,能解决特征冲突,还介绍其技术原理与各任务效果。
云知声发布U2-Flash,要争“大模型主力位”|甲子光年
本文报道云知声发布U2-Flash大模型,基于原有U2基座,通过创新后训练方案提升Coding、Agent等复杂任务能力,多项评测比肩头部模型,目标成为企业真实生产任务的主力大模型。
刚刚,Anthropic公布Fable 5.1保姆级使用技巧,看完少走十天弯路
Claude Fable 5.1虽可兼容旧版提示词,但行为习惯有变化。官方整理提示词与工程落地指南,涵盖思考程度、工具调用进度汇报、独立工具批量调用等多方面使用技巧和避坑细节。
拆解 Claude 5.1:38 小时不睡觉的背后,Anthropic 正在终结「模型论」
Anthropic 更新 Claude 5.1,推出 Fable 5.1 和 Mythos 5.1,将‘智力’与‘权限’物理剥离。前者负责通用任务,后者面向专业场景。此次更新展示模型解决长时任务状态一致性等问题的能力,还体现了能力权限分离等变化。
DeepSeek睁开眼了!Opus-4.8的性能,1000张图不到20美分
DeepSeek首个多模态视觉模型deepseek-v4-flash-vision-exp上线DeepSeek API平台。文本能力与V4-Flash持平,多模态Agent能力逼近Opus-4.8,分析1000张图成本不到20美分,还上线免费Files API。
开启Benchmark的Harness时代:15家学术机构联合发布HarnessEval
8月13日,DeepSeek开源Agent Harness dsh引发行业对“Harness”的关注。近日,MirroS联合多机构发布HarnessEval,将其概念引入评测系统。它使评测从Metric到Harness,形成可执行评测系统,已落地于交互式世界模型。