推荐文章7
大模型微调:搞清何时不该调
机器学习AI算法工程
AI 摘要
文章认为微调失败多是不该调。微调解决行为问题,非能力问题。常见不该调场景有知识接入、Prompt没写好等,建议先验证思路,明确目标,成熟团队要知何时收手。
阅读原文 · 机器学习AI算法工程
什么时候不该微调:比“怎么微调”更重要的一件事
文章指出微调失败常因一开始就不该调。强调微调解决行为问题而非能力问题,还列举了不该微调的五种场景,如知识接入问题、Prompt没写好等,建议先验证思路,明确目标再行动。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
推荐文章7
双向钢人Prompt:帮你挖出问题本质答案
作者分享推特上一个让大模型深度思考的Prompt,调研后引入‘钢人论证’概念,指出其能避免AI谄媚。作者还写双向钢人Prompt,介绍其作用,并以公司司庆日选择为例展示效果。
数字生命卡兹克
算法论文8
0.01%参数,大模型低数据微调新方案
瑞典隆德大学与Google DeepMind团队研究大模型微调省参方案。发现低数据场景下,微调Value投影中的b(v)比b(q)或b(k)性能更好。该研究已被ACL 2026接收,集成进Hugging Face - PEFT库。
量子位
推荐文章7
LLM Wiki 工程实践与 RAG 融合应用
文章介绍 LLM Wiki 工程实践。包括为 AI Coding 创建知识地图,指导 Agent 加载上下文;在 Obsidian 构建知识体系,有插件和自定义 Agent 两种方法;还分析其与 RAG 关系,指出可融合互补,不要过度神话 LLM Wiki。
AI大模型应用实践
推荐文章7
从 LLM Wiki 到 Google OKF 重建知识底座
文章深入解读 LLM Wiki 与 Google OKF,探讨如何重建企业 Agent 可靠知识底座。指出 RAG 检索有局限,Wiki 式体系可整理知识。介绍 LLM Wiki 构想、OKF 规范及构建符合 OKF 约定的 LLM Wiki 的方法。
AI大模型应用实践