「训练流程」共找到 2791 篇相关文章
开源即屠榜!UniME多模态框架登顶MMEB全球训练榜,刷新多项SOTA纪录
格灵深瞳等团队联合发布通用多模态嵌入新框架UniME,刷新MMEB训练榜纪录。它是两阶段框架,经文本判别知识蒸馏和困难负样本增强指令微调,在多任务达SOTA,项目已开源。
LeCun力荐的JEPA杀入LLM,用CV的思路训练LLM,性能鲁棒性双丰收
LeCun团队提出LLM - JEPA,将JEPA自监督学习架构从视觉扩展到LLM。它能提升性能和鲁棒性,在多模型和数据集验证有效,但有训练开销大、泛化性不足等局限。
直播预约 | SwS: 强化学习训练能否不依赖外部知识优化模型的弱点?
该论文提出强化学习场景下的启发式数据合成流程(SwS),利用模型自我感知弱点驱动自动化问题生成,弥补推理缺陷。对其扩展后适应性更广,在多基准测试集和模型上验证有效,性能提升显著。
75%预训练数据都能删!Jeff Dean新作:全自动筛除低质量数据
Google DeepMind团队开发的DataRater可全自动评估数据质量,用元学习筛选有价值数据,提升模型训练效率。它能减少计算量、提高性能,在低质量数据集效果佳,还能跨模型规模泛化。
仅凭一篇博客,他成功入职OpenAI!核心技术或用于GPT-5训练
Keller Jordan设计Muon优化器并公开研究进展,引OpenAI和xAI关注,最终加入OpenAI。Muon性能卓越,或用于GPT - 5训练,其故事暗示传统论文模式在AI领域或已落伍。
离职特斯拉“隐身”14个月,杨硕创业终于亮牌:重新定义机器人训练范式
杨硕从特斯拉擎天柱团队离职创业一年多后,妙动科技团队带来新论文《DiT4DiT: Jointly Modeling Video Dynamics and Actions for Generalizable Robot Control》。该团队用视频训练机器人动作,提出DiT4DiT模型,解决VLA模型不懂物理问题,在人形机器人上有新突破。
AAAI 2026 | 革新电影配音工业流程:AI首次学会「导演-演员」配音协作模式
现有AI配音缺“人情味”,因跳过“导戏”“揣摩”环节。内蒙古大学刘瑞教授团队在AAAI 2026提出Authentic - Dubber框架,模拟真实配音流程,实验显示其情感表达优势明显,提升了AI配音竞争维度。
不平衡数据下对比学习的理论分析:从训练动态到剪枝解决方案
本文第一作者为新泽西理工学院廖海旭。对比学习在类别不平衡数据下面临挑战,此前研究未考虑其影响。本文构建理论框架刻画训练动态,定量分析少数特征影响,提出剪枝算法增强少数特征学习,实验验证其有效性。
SIGGRAPH 2026 | 无需训练,一段单目视频解锁任意运镜与「子弹时间」
来自UIUC、宾大与Netflix Eyeline Labs的研究团队提出FreeOrbit4D,无需训练模型,用单目视频就能实现任意运镜和“子弹时间”。它通过“前景补全的4D重建”提供几何支架,在大角度视角变化下表现出色,还带来诸多应用。
Vision-Zero:零数据VLM自我进化!陈怡然团队提出零监督训练新范式
陈怡然团队提出零监督训练新范式Vision-Zero,在多模态任务表现突出。它借鉴自博弈技术,设计自博弈框架,解决数据稀缺和知识天花板问题,还缓解跨能力负迁移,开源代码与模型可供研究。