全量微调」共找到 2577 篇相关文章

开源动态7

Unsloth-MLX:在Mac上微调LLM,代码无缝迁移到云端GPU

对于Mac用户,在原型实验阶段反复租云端GPU是资源浪费。开发者推出Unsloth - MLX,基于MLX框架,让Mac用户本地高效微调大模型,改一行导入语句就能无缝迁移代码到云端,还介绍项目特点、状态等。

AI工程化
新闻资讯8

让AI自己设计芯片!中国科学院发布「启蒙」,芯片流程自动设计

近日,中科院计算所联合软件所推出「启蒙」系统,基于AI实现处理器芯片软硬件流程自动设计,达到或部分超越人类专家水平。该系统在多方面表现出色,如设计的CPU达ARM Cortex A53性能等。

新智元
算法论文7

Meta最新大模型RL微调:在线DPO/GRPO显著优于离线DPO

Meta和NYU研究强化学习在大模型微调中的有效性,对比离线、半在线和在线训练范式。半在线和在线显著优于离线,多任务结合可验证与不可验证任务能提升性能,还给出不同任务的测试数据。

PaperAgent
算法论文8

0.016%参数撬动18%性能:关键表征微调破解LLM推理瓶颈

大语言模型在推理任务依赖思维链技术,传统PEFT方法需修改大参数,新兴ReFT虽只需调整少参数,但存在不足。本文提出CRFT,仅用0.016%参数就提升性能,为轻化推理增强开辟新路径。

深度学习自然语言处理
产品应用8

网首测!首款国产GPU「AI算力本」现场上手

新智元报道首款国产GPU「AI算力本」MTT AIBOOK,它搭载国产功能显卡,预装开发环境,打破系统壁垒。其背后的MUSA架构栈自研,软件升级、有翻译工具,硬件架构革新,还有开源计划,产品应用广泛。

新智元
产品应用7

Unsloth发布Qwen3-VL本地运行和微调指南,修复隐藏bug

Unsloth团队修复Qwen3-VL系列模型聊天模板语法问题,重新上传GGUF化文件,使模型可本地稳定运行。介绍了不同规格模型硬件需求、表现,给出部署步骤、参数差异,还展示多模态能力测试,提供多种格式模型及微调工具。

AI工程化
算法论文7

苹果提出新型反向传播:一台iPhone 15 Pro Max就能微调LLM

苹果提出内存高效型反向传播(MeBP),可在内存使用和计算时间上比零阶优化(ZO)有更好权衡,收敛更快、性能更优,还在iPhone 15 Pro Max验证其有效性,且公开了实现链接但目前为空。

机器之心
算法论文8

超越对数似然:模型能力连续体下的监督微调新范式

论文挑战监督微调(SFT)用负对数似然(NLL)作训练目标的默认设定,提出基于概率的目标家族,引入“模型能力连续体”概念,分析不同目标在不同模型能力下的表现,为模型后训练提供新优化方向。

深度学习自然语言处理
产品应用8

数字生活的原生入口:蚂蚁集团发布AI眼镜新技术框架gPass

日前,蚂蚁集团在2025 Inclusion・外滩大会发布球首个智能眼镜可信连接技术框架gPass,具备“安、交互、连接”能力,可解决AI眼镜生态痛点,已应用于部分品牌,未来将释放更多潜能。

机器之心
产品应用8

DeepSeek-R1升级V2版:Token成本低至原来30%

DeepSeek - R1 V2版维度升级,训练框架从‘单一RL’到‘多阶段协同优化’,推理能力从‘能推理’到‘会优化推理’,还提升了安可控性,适配生态,推出轻级模型。

CourseAI