「全参数微调」共找到 2650 篇相关文章
13年死磕一个真理,这家中国AI黑马冲刺IPO
云知声深耕AI 13年,即将冲刺港交所IPO。它从单一语音识别发展为全栈AGI方案商,以智慧生活和智能医疗双轮驱动,营收稳健增长。其坚持技术创新,构建全栈自研体系,有望在AI时代持续领跑。
以小博大!Nanbeige4-3B重磅开源:硬刚Qwen3,挑战小模型能力新高度
近年来大语言模型参数膨胀,成本升高,业界重注小语言模型。近日,Boss直聘南北阁大模型实验室发布仅30亿参数的Nanbeige4 - 3B,在多方面媲美甚至超越通义千问Qwen3系列模型,开源印证小模型潜力。
AI办公斩杀线,一页文档多少钱
腾讯混元Hy4 preview正式发布并开源,参数770B,是开源阵营里参数最大的Apache 2.0模型。它能处理长文本,官方定位有软件工程、办公分析等四个方向。还分析了处理一页文档的成本,指出办公AI下半场重在‘读懂’。
Make SFT Great Again!从SFT到DFT:一权重之差,泛化之跃
大型语言模型的监督微调(SFT)简单高效,但泛化能力弱于强化学习(RL)。本文直击 SFT 核心缺陷,揭示其泛化瓶颈源于隐含的“病态奖励结构”,并提出仅需单行代码修改的动态微调(DFT),实验表明其效果显著。
国民技术发布面向AI数据中心的3 kW数字电源参考设计方案
在AI算力增长与能源转型驱动下,电力供给变革。国民技术发布面向AI数据中心的3 kW数字电源参考设计方案NS3KW53V5P2L3,基于N32H474芯片和Hunter OS生态,有高转换效率等优势。
右兔短视频去水印工具正式上线!
右兔去水印工具,一键解析全网短视频,无需广告,免费下载,支持高清原画质。
AI Agent的上下文工程:构建Manus的经验教训
上下文工程是AI智能体的“系统一”,决定其速度、恢复力与扩展边界。Manus通过试错与用户验证,给出可复用经验,如利用大模型“上下文学习”能力、关注KV - cache命中率等。
国产GPU组了个开源局,把SGLang等核心开发者都摇来了!
国产GPU玩家摩尔线程举办SGLang × MUSA Meetup,邀请众多开源圈开发者。活动探讨如何让国产GPU进入大模型推理主流开源工程链路,显示国产GPU竞争迈向生态坐标之争。
快手进军AI编程!“模型+工具+平台”一口气放三个大招
AI编程竞争激烈,快手发布AI编程产品矩阵进军该赛道。其“三位一体”矩阵含顶尖自研模型、智能开发工具和MaaS平台,KAT - Coder - Air轻量版免费。各产品亮点多,助力构建AI编程新生态。
刚刚,马斯克 xAI 联合创始人离职
xAI联合创始人Igor Babuschkin离职并宣布创立Babuschkin Ventures,专注AI安全研究。他回顾xAI成就,如120天建成Memphis超级集群。马斯克致谢,网友关注并表达看法。