「分析 - 解析范式」共找到 2235 篇相关文章
OpenAI发长文自曝家丑:搞砸了GPT-4o更新,模型“拍马屁”复盘与总结
OpenAI官网发布长文,详细拆解了一次失败的GPT-4o模型更新。此次更新使模型变得“谄媚”,OpenAI解释了原因,包括奖励信号失衡等。还分析了部署前评审流程失效的因素,并表示从中学到诸多经验教训,将修改评审流程等。
AI+ Kuikly:7.5小时落地三端「多模态聊天 App」实战
腾讯开源的高性能跨端框架 Kuikly,搭配 AI 开发,仅用 7.5 小时交付一套支持 Android、iOS、鸿蒙三端的 AI 聊天 App。介绍了开发过程,包括环境准备、需求分析、编码实现、集成自测、迭代优化和验收复盘,展示了“AI + Kuikly”的高效。
Mastra 还是 LangGraph.js?选型先看三条断层线
2026 年上半年,TypeScript 团队做 AI Agent 常面临 Mastra 和 LangGraph.js 选型难题。二者功能清单趋同,但工程哲学不同。文章从语言原生与跨语言移植、缩到零的 serverless 与常驻的持久化、完整工具箱与自由原语三条断层线分析选型依据。
九章云极发布AI工厂体系:破解140万亿Token时代的落地悖论|甲子光年
九章云极于6月17日发布Alaya NeW AI工厂体系,锚定十万P算力、十万亿Token、千个模型、千倍降本四大目标。该体系是智能工业化的必然产物,能解决资源难转生产力的难题,还具备技术效能、生态范式和商业飞轮三大支柱。
Anthropic 联创:2028 年实现 AI 自我构建的概率超过 60%
Anthropic 联合创始人 Jack Clark 发长文称,到 2028 年底,AI 实现端到端自动化研发概率超 60%。他分析多维度测试数据,指出 AI 在代码、科研、自我训练和管理等方面能力提升,也探讨了成真后的影响,但遭黄仁勋和陶哲轩质疑。
AMD服务器上一个诡异的性能问题诊断历程
本文复盘AMD服务器高优故障,从8月底起,集团amd turind机器业务cpi和cpu利用率飙升,影响业务性能。经排查是split lock问题,由python解释器调用__libc_free时出错引发,还分析了问题原因、传导路径,并给出应对措施。
NUS LV Lab新作|FeRA:基于「频域能量」动态路由,打破扩散模型微调的静态瓶颈
在大模型时代,参数高效微调(PEFT)已成为迁移大规模扩散模型至下游任务的标准范式。但现有微调方法多采用「静态」策略,忽略扩散生成过程内在规律。新加坡国立大学LV Lab等机构提出FeRA框架,通过频域能量动态路由,实现高效微调。
MOE RL实战:统一FP8全流程训练
SGLang RL团队等联合完成工作,实现RL中全流程FP8训练与采样。介绍FP8训练硬件基础、格式、scale选择等,指出训练难点,分析KL Loss异常归因,验证其在MoE模型RL应用效果,还探究模型规模对训推不一致性的影响。
华为超树HTP:不写示例、不调PDDL,AI规划约束通过率飙升62.6%
文章介绍华为超树HTP,它是完全自主、可泛化的推理新范式。能让LLM在超树结构上完成规划,不依赖人工示例和外部规划器,在复杂规划benchmark上实现SOTA准确率并降低token成本,还阐述其原理、创新点及应用实例。
苹果不吹 AI,反而成功了?
北京时间9月10日苹果发布会,新款iPhone等产品更新。此次发布会多数环节AI几乎消失,与iPhone 16发布时大肆宣传不同。苹果因在智能体AI助手进展落后,重点放硬件及AI幕后支持。不过苹果仍承受分析师压力,且在AI竞赛中落后。