「训练优化」共找到 3096 篇相关文章
重磅!翁荔最新Scaling Law深度洞察来了
北大毕业的前OpenAI高管翁荔(Lilian Weng)的《Scaling Laws, Carefully》值得一读。Scaling law是预训练预算表,能帮少烧错钱。文章探讨大模型训练预算分配,分析Kaplan和Chinchilla结论差异及数据稀缺问题。
百度AI+ DeepSeek 豆包等GEO怎么做出排名?5个技巧,附快排与白帽操作区别
文章介绍GEO优化在AI大模型2 - 3天出排名的5个技巧,包括官网SEO梳理、词库挖掘整理、内容数据投喂、市场竞对分析和技术策略微调,还对比快排与白帽GEO服务商,强调合规操作。
Agent开始“自我进化”:会出题、会反思,还会自己长出新技能
文章围绕自进化Agent展开,介绍其概念、受重视原因及三大技术路线,涵盖各路线代表工作的特点、评估及对比,指出研究空白如总结者训练等,最后还介绍了基于Agentic AI的全链路数据助手Dola。
最新豆包、deepseek、元宝、夸克、千问、百度、文心、Kimi、微信搜一搜、抖音、小红书等AI搜索生成内容引用来自哪些地方?【干货】
作者白杨SEO指出,生成式人工智能发展快,AI搜索优化GEO受关注。介绍了豆包、DeepSeek等多个AI搜索生成内容引用来源,如豆包引用抖音、头条等,DeepSeek用开源数据等,还提及各平台优化要点。
4小时喜提专属 ChatGPT、卡帕西又整活!自曝Agent帮倒忙、手搓八千行代码,网友:跑完就当上机器学习工程师
特斯拉前AI总监安德烈·卡帕西发布开源项目nanochat,是极简全流程训练/推理工具链,可搭建简易版ChatGPT复现模型。花100美元最快4小时能训练出可对话模型,代码基本手写,网友热度高。
100美元、仅8000行代码,复现ChatGPT,Karpathy:这是我写过的最疯狂的项目
特斯拉前AI总监Andrej Karpathy发布全新开源项目「nanochat」,是极简且完整的「从零构建ChatGPT」训练框架。不到12小时GitHub星标破4.2k。约8000行代码,花100美元、4小时就能训练出专属「小ChatGPT」。
从自己出题到自己选题:耶鲁新方法让大模型 Self-Evolution 又进一步
本文解读了耶鲁、斯坦福等多机构联合提出的INFUSER大模型自进化新方法,针对现有方法仅以难度筛选训练数据的缺陷,提出用影响力分数筛选高价值训练题,实现双模型协同动态进化,实验验证效果显著。
AI 怎么自我改进?Lilian Weng 的答案是:先写好Harness
提出 Agent 基本公式的 Lilian Weng 探讨 AI 递归自我改进,强调‘harness’重要性,介绍其设计模式、优化方法,还提及未来挑战与有用基准。如 harness 工程额外包含工作流设计等,优化方式多样但也面临评估器弱等问题。
社区供稿丨以小博大!Nanbeige4-3B重磅开源:硬刚Qwen3,挑战小模型能力新高度
近年来大语言模型发展陷入‘参数军备竞赛’,成本高昂。Boss直聘南北阁实验室发布Nanbeige4 - 3B,仅30亿参数,在预训练和后训练阶段采用多种创新技术,在多方面媲美甚至超越大模型。
转译:AI 为啥这么爱用破折号?
文章探讨AI爱用破折号的原因,指出让模型不用破折号很难。分析了几种解释,如从训练数据学来、因“万金油”特性、受RLHF工作者方言影响等,认为训练数据混入大量纸质扫描书是最可能的原因。