「在线后训练」共找到 3845 篇相关文章
推荐系统进入“大模型时刻”:昇腾NPU如何支撑千亿级生成式推荐落地
文章基于华为郭威在2025 AICon大会演讲,复盘华为推荐技术探索。介绍FuXi-α、β模型设计,解决训练和推理难题;分享“多阶段统一建模”进展,提出Performance Law;还介绍了训推系统优化及未来聚焦“强算力”“强模型”融合。
LLM的下一战:从狂卷数据到精算数据
大模型竞争核心正从比拼数据规模转向数据使用效率和风险管理。文章分享2025两篇论文,介绍高效训练和机器遗忘两赛道,前者有数据价值飞轮5大模块,后者提出三时段分类法、三层次遗忘及评价指标全景。
OpenAI秘密项目曝出!百名投行精英密训AI,华尔街最贵苦力要失业了?
OpenAI秘密项目「Mercury」曝出,正高薪招募百名前投行精英训练财务模型,替代初级银行家重复性工作。业内认为这是其在算力成本高企下加速商业化与盈利的关键一步,也引发对银行从业者就业与成长的讨论。
基于 Gemini 模型做 SEO Agent 简单实战
作者参加 Google I/O 大会后,受 James 用 AI 做 SEO 启发,尝试基于 Google 的 Gemini 2.5 Pro 模型制作 SEO 智能体。介绍数据获取方法,构建 3 个 Agent 进行分析、提建议和输出报告,Gemini 负责理解决策,适合出海企业。
750城市+5000小时第一人称视频,上海AI Lab开源面向世界探索高质量视频数据集
上海人工智能实验室等机构联合推出持续迭代的高质量视频数据集项目Sekai,含Sekai-Real和Sekai-Game两个数据集,还训练了模型Yume。它特点突出,团队按四环节构建,望成世界建模等领域的数据基石。
One RL to See Them All?一个强化学习统一视觉-语言任务!
国内初创公司 MiniMax 提出 V-Triune 系统,可让 VLM 单一训练流程学视觉推理和感知任务。它含三个组件与动态 IoU 奖励机制,基于此的 Orsta 模型在多项测试中性能提升显著,凸显统一 RL 方法有效性和可扩展性。
回敬 Codex,Claude Code 推出 /goal 功能,不干完不睡觉
Claude Code随2.1.139版本推出 `/goal` 命令,设定完成条件后可持续工作至目标达成。它与Codex互相借鉴功能,且在设计上采用裁判分离,官方也给出目标制定建议,还带来其他更新。
硅谷直击:黄仁勋入局龙虾大战,宣告 SaaS 已死,推理算力需求暴涨万倍!
本文为 CSDN 对英伟达 GTC 2026 大会的现场报道。黄仁勋宣告 SaaS 已死,揭幕 Agent 时代,指出 AI 重心正从训练转向推理,还推出 Vera Rubin、LPX 等新品,强调能效即钱,企业软件将向 Agent-as-a-Service 转变。
小米开源首个跨域具身基座模型MiMo-Embodied,29个榜单SOTA
小米具身智能团队开源跨域基座模型MiMo - Embodied,它融合自动驾驶与具身智能,在29个榜单创SOTA。该模型基于MiMo - VL架构,采用四阶段训练策略,有效解决领域割裂问题,为通用VLA模型奠定基础。
创始人自曝让儿子辍学用AI上课、水平超同龄人!俞敏洪最先押注的“AI学校”,负债9亿不垮、现在要开到美国了
松鼠Ai创始人栗浩洋让儿子辍学用AI上课,称其水平超同龄人。该公司由俞敏洪最早投资,曾负债9亿,后转型推出学习机业务。如今计划将‘AI学校’开到美国,正做相应市场适配调整。