LLM训练」共找到 2862 篇相关文章

新闻资讯7

突发!OpenAI停止强化学习训练两周

OpenAI发文称暂停最新模型强化学习训练两周,加固研究环境、进行红队测试等。部分低风险训练已恢复,最大规模前沿模型训练仍暂停。此举源于Hugging Face安全事故及Astra模型潜在风险。

机器之心
算法论文8

Claude团队用Qwen测试全新训练方法

Anthropic最新研究提出中训练(MSM),在预训练后、后训练前给AI立规矩。实验显示,新增MSM能让通义千问两款32B大模型失准率大幅下降,还能精简微调数据。MSM与对齐微调结合,可提升模型泛化能力。

量子位
产品应用8

训练MoE足足提速70%!华为只用了3招

Scaling Law下,MoE成扩展模型能力法宝,但训练难题凸显。华为构建Adaptive Pipe & EDPB优化方案,还打造DeployMind仿真平台,解决了MoE训练中通信等待、负载不均等问题,使训练吞吐提升72.6%。

量子位
推荐文章7

听说,大家都在梭后训练?最佳指南来了

大模型时代,Scaling Law 边际效益递减,业界转向后训练。《Post-training 101》博客可助初学者入门,涵盖从预训练到指令微调、SFT 原理、多种强化学习技术及模型评测方法等内容。

机器之心
推荐文章8

让AI变成Super员工的秘密:高效训练Skills

文章复盘打造 web - testing Skill 的 4 个翻车教训,分享工程化训练心法。指出训练 Skill 能让 AI 在业务里更可靠,将通用模型变成懂业务、会自检、能稳定交付的员工,还给出训练方法。

腾讯技术工程
新闻资讯7

ICLR 2026史上最严新规:论文用LLM不报,直接拒稿!

ICLR 2026官方组委会发布「LLM使用新政」,规定用LLM写论文、审稿须明示,作者和审稿人对内容负全责,违规者直接拒稿。还举例说明LLM在不同场景使用的后果。

新智元
推荐文章8

Karpathy:LLM渴望的不是生存,而是你的点赞

Andrej Karpathy指出人们对‘智能’理解肤浅,动物智能与LLM智能源于不同优化压力。动物智能源于自然选择,而LLM智能来自统计模拟、强化学习微调等,两者在多层面有差异,LLM受商业进化影响大。

AI寒武纪
推荐文章7

LLM for AIOps:是泡沫还是银弹?智能运维的争议、破局与未来

大模型浪潮下,LLM Agent 在运维领域既被寄予厚望,也饱受争议。「AI 进化论」第六期直播聚焦此话题,阿里云冯富秋和云杉网络向阳从痛点、破局、未来规划解析 LLM 与 OS 协同之道。

InfoQ
算法论文8

ICLR 2026 Oral | Revela:用语言建模重新定义稠密检索器训练

在检索增强生成系统中,稠密检索器是核心组件,但传统训练方法有局限。德国达姆施塔特工业大学蔡丰宇团队提出Revela,将检索器训练目标统一到语言建模框架,优势明显,实验效果佳。

机器之心
新闻资讯8

英伟达:RLP 让 AI 在预训练时就学会思考

英伟达研究团队发布 RLP 技术,与传统大语言模型训练不同,它在预训练阶段就让模型学会'先想后说'。通过奖励机制自我监督,实验效果惊人,性能提升显著,不挑数据,打破了大模型训练范式。

AI工程化