全量微调」共找到 2591 篇相关文章

新闻资讯8

陈大年复出,入局大模型

国产大模型领域黑马StartLux-V1.0-27B-Preview,参数仅27B,在信通院MCP测试中排综合第二,仅次于1.6万亿参数的DeepSeek-V4-Pro。其创始人陈大年押注本地模型,公司专注该领域商业化。

量子位
开源动态8

浙江大学联合华为发布国内首个基于昇腾千卡算力平台的DeepSeek-R1-Safe基础大模型

2025年9月18日,浙江大学任奎教授团队联合华为在“华为联接大会2025”发布国内首个基于昇腾千卡算力平台的DeepSeek-R1-Safe基础大模型,提升了我国AI系统自主安防控水平,该模型已面开源。

AIGC开放社区
推荐文章8

AI Coding 赛道,Solo 创业、6 个月 8000 万卖掉,独立开发的新传奇

Maor Shlomo开发栈无代码平台Base44,6个月获25万用户后8000万美元卖掉。他复盘了从搭建到推广的流程,分享产品切入点、与AI协作、渠道增长等经验,强调做喜欢之事,把握用户‘顿悟时刻’。

Founder Park
推荐文章7

2025,大模型文档解析(OCR)年终盘点

2025年6月以来文档解析方法快速增长,有10余种。按“技术路线 + 工程形态”可归为4大类:传统级联流水线、轻多模态两段式、通用多模态大模型一段式、轻多模态一段式,各有优劣,4条路线覆盖所有OCR落地场景。

PaperAgent
新闻资讯8

浙江大学联合华为发布国内首个基于昇腾千卡算力平台的DeepSeek-R1-Safe基础大模型

2025年9月18日,浙江大学任奎教授团队联合华为在“华为联接大会2025”发布国内首个基于昇腾千卡算力平台的DeepSeek - R1 - Safe基础大模型,提升了我国AI系统自主安防控水平,任奎获“科研创新卓越贡献奖”。

AI大模型应用实践
新闻资讯7

微软最新揭秘:「话痨实习生」AI助手,到底能帮人类做什么?

基于20万微软Copilot使用数据的研究指出,AI能支持研究、写作和沟通任务,但无法完胜任单一职业所有任务。Copilot执行任务多为解释型,写作和信息收集任务满意度高,语言和创作类职业受影响大。

新智元
新闻资讯8

13年死磕一个真理,这家中国AI黑马冲刺IPO

云知声深耕AI 13年,即将冲刺港交所IPO。它从单一语音识别发展为栈AGI方案商,以智慧生活和智能医疗双轮驱动,营收稳健增长。其坚持技术创新,构建栈自研体系,有望在AI时代持续领跑。

新智元
开源动态8

蚂蚁百灵新一代Ling-3.0开源,智效比13.2,124B释放1T能力

蚂蚁百灵新一代模型Ling-3.0开源,有flash和tiny两版本。Ling-3.0-flash参数124B,智效比13.2,输出快成本低;Ling-3.0-tiny参数7.9B,激活少且适用多场景,二者都极致挖掘模型效率。

AIGC开放社区
开源动态8

消费级显卡可以快速上手跑!面壁智能MiniCPM-o 4.5发技术报告

面壁智能联合多方发布MiniCPM-o 4.5技术报告。该模型是业界首个端到端双工模态大模型,参数约9B,依托Omni - Flow框架,多项性能对标前沿大模型,还推出多种使用方式,兼顾普通用户与开发者需求。

量子位
算法论文8

Make SFT Great Again!从SFT到DFT:一权重之差,泛化之跃

大型语言模型的监督微调(SFT)简单高效,但泛化能力弱于强化学习(RL)。本文直击 SFT 核心缺陷,揭示其泛化瓶颈源于隐含的“病态奖励结构”,并提出仅需单行代码修改的动态微调(DFT),实验表明其效果显著。

深度学习自然语言处理