新闻资讯8
大模型竞赛决胜关键:后训练
甲子光年
AI 摘要
大模型竞赛焦点转向后训练,如Grok 4靠强化学习投入获强大推理力。产业应用中通用模型适配难题凸显,后训练方法进化,夸克和阿里云给出实践方案,阿里云提供一体化支撑。
阅读原文 · 甲子光年
大模型竞赛转向:决胜关键为何是“后训练”?|甲子光年
大模型价值主战场向后训练转移,Grok 4凭后训练成“宇宙最强”。产业应用中通用模型适配难,后训练方法也在进化,如采用SFT+RL等,还介绍了夸克和阿里云的后训练实践。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
产品应用8
阿里Qwen3.8-Flash发布,性价比惊人!
8月大模型厂商多上调API价格或收缩免费额度,因推理需求增长跑赢算力供给。阿里发布Qwen3.8-Flash并开源,成绩亮眼且价格低。它是Qwen4架构预演,有四大技术创新,提升了模型效率。
机器之心
新闻资讯8
OpenAI自研芯片性能超英伟达,2026年部署
8月25日,OpenAI公布自研推理芯片Jalapeño性能测试结果,首次给出其在多款公开大模型上的具体数据。该芯片在低功耗下实现高推理吞吐量和低延迟,性能超英伟达芯片,B0版已进入制造阶段。
DeepTech深科技
开源动态8
港科大同腾讯开源3D构建框架超GPT - 5.5
香港科技大学(广州)联合腾讯AI平台部提出VibeWorlding,是可通过多轮对话等自主构建和编辑交互式3D世界的多模态智能体框架。团队开源多项数据,其模型经强化学习后表现超GPT - 5.5等。
机器之心
算法论文8
颜见智团队:启发学习让大模型自我进化
当下大模型能力多靠人为框架,能力上限受限。文章提出“启发学习”,将其集成到推理侧成Isaac框架,通过Prompt与网络层注入复用旧经验,实验显示能大幅提升大模型任务性能。
机器之心