自进化训练」共找到 3429 篇相关文章

开源动态8

他们让万亿参数RL学会了「省着跑」,顺便砍掉九成算力

2025年,强化学习成大模型进化主战场,但万亿参数模型跑RL成本高。Mind Lab团队实现1T参数模型LoRA高效RL训练,GPU消耗降90%,技术开源。此外还有Memory Diffusion记忆机制等成果。

量子位
新闻资讯8

一个大脑搞定所有模态,百度ERNIE 5.0技术报告公布

模型发布近3个月后,百度ERNIE 5.0技术报告公布。其底座用超级稀疏架构,参数量万亿但推理激活参数不到3%,实现四种模态原生回归统一,还在路由调度、训练范式等多方面有创新。

量子位
新闻资讯7

刚刚,1500名作家向 AI 宣战!

1500位作家联名向美国出版商发公开信,要求拒绝AI生成的书籍内容,称创作被AI“偷走”,还指出AI有声书取代人类、耗能大等问题。此前法院裁定用受版权书籍训练AI属合理使用。

AGI Hunt
算法论文8

钉钉DeepResearch, 0.008元/1k Token击穿地板价

阿里为7.5亿钉钉用户推出Dingtalk - DeepResearch,解决企业办公AI化痛点。系统采用“三横一纵”架构,有多阶段强化学习等三种解法及DingAutoEvaluator纵向飞轮,实现模型进化纠错。

CourseAI
算法论文7

The Batch:927|极速扩散学习

研究表明扩散图像生成器学习重建预训练编码器嵌入可加快训练,Apple团队提出的FAE,通过缩小嵌入再重建解决了因嵌入尺寸大导致的训练受阻问题,性能与先进模型相当且训练更快。

DeeplearningAI
开源动态8

阿里Qwen3技术报告核心要点解读!

阿里Qwen3技术报告发布,披露模型架构、预训练及后训练等技术细节。其有密集与混合专家两种模型架构,预训练数据量和语种增多,后训练采用强到弱蒸馏提升性能,各模型表现优异。

PaperAgent
开源动态7

我们开源了一个可以降低 AIGC 率的模型

毕业季学校查 AI 率,作者为降 AIGC 率,经尝试不同路径后训练出模型。介绍训练数据和过程,包括 SFT、DPO 各阶段,展示改写效果,还开源模型和数据,最后引发对教育检测的思考。

特工宇宙
算法论文8

最新视觉大模型 DINOv3论文精读(逐段解析)

DINOv3是突破性监督视觉基础模型,其创新围绕数据与模型协同扩展、Gram锚定技术、多阶段训练策略。它解决传统监督学习难题,在多任务上无需微调达最优,为计算机视觉树立新标杆。

机器学习AI算法工程
开源动态8

刚刚,小红书开源了首个多模态大模型dots.vlm1,性能直追SOTA!

小红书人文智能实验室(hi lab)低调开源视觉语言模型dots.vlm1。该模型基于研视觉编码器构建,在视觉理解和推理任务上接近SOTA水平,实测表现惊艳,还介绍了其技术架构、预训练数据布局等内容。

新智元
算法论文7

Reasoning模型可以Self-Train!

当前大模型依赖人类标注数据,成本高且扩展难。论文探讨模型我纠错、进化可能,提出我奖励训练(SRT),用投票共识代替人类标注。在数学数据集上有效果,但高难度数据集出现问题,作者给出解决办法并开源代码。

深度学习自然语言处理