「中训练」共找到 4195 篇相关文章
第二代AI预训练范式:预测下个物理状态
英伟达科学家 Jim Fan 发布《第二代预训练范式》,指出当前以 LLM 为代表的第一代范式应用于物理世界时「水土不服」,认为第二代范式是「预测下一个物理状态」,引发机器学习社区讨论。
Kubernetes环境中作业帮大模型服务流量调度优化实践
随着大语言模型应用渐广,Kubernetes 现有 Ingress 组件在大模型服务流量管理上有局限。作业帮提出创新调度方案,整合成模型网关,具备五项核心功能,提升了资源效率、稳定性和易用性。
训练机器人方式对了吗?英伟达DreamZero双榜第一新反思
NVIDIA的DreamZero在RoboArena和MolmoSpaces基准测试双登顶。分析文章《Why is DreamZero so good at robotics?》从多维度拆解其表现突出原因,质疑传统认知,如数据量并非万能,模型规模和信息输入方式也很关键。
Google 在 AI 竞赛中如何从落后到反超的故事
本文讲述 Google 在 AI 竞赛中从落后到反超的历程。曾因傲慢错过先机,ChatGPT 问世后 Google 陷入恐慌,后通过创始人回归、团队合并、召回人才等举措,让 Gemini 模型多项指标超越 ChatGPT,实现逆袭。
20万人抢的全球大模型第一股,我中签了
智谱在港交所上市成全球大模型第一股,作者申购中签。智谱专注AI Coding,迭代快,GLM - 4.7成绩亮眼,商业化数据佳,还有诸多有意思细节,虽行业竞争大,但它表现不错。
强化学习新发现:无需数学样本,仅游戏训练AI推理大增
莱斯大学、约翰斯・霍普金斯大学和英伟达研究团队有颠覆性发现,让多模态大语言模型玩简单游戏,无需数学样本,就能显著提升其多模态推理能力。提出的ViGaL方法在多个基准测试中表现出色。
《AI Agent智能体技术发展报告》正式发布 | 中科算网算泥社区
1月13日,中科算网算泥社区主编、中国工业互联网研究院参编的《AI Agent智能体技术发展报告》发布。报告梳理了AI Agent技术进展、产业格局等,对其进行精准“再定义”,介绍发展阶段、2025年核心突破、产业生态等内容。
LightLLM中DeepSeek V3/R1 Two MicroBatch Overlap 实现解析
文章围绕LightLLM中DeepSeek V3/R1的Two MicroBatch Overlap实现展开。介绍了该技术原理,通过拆分推理过程、精心设计执行顺序实现计算与通信重叠。还阐述了数据结构设计、预处理、核心执行流程,以及优化策略和配置启用方式。
创建“中国的ASML”!中芯国际、北方华创等掌舵人联名建议
多位中国集成电路行业领军人物联合撰文,提出在‘十五五’期间通过整合机制,集中力量解决极紫外光刻等关键问题,建议创立‘中国的ASML’,还设定了未来五年产业发展的量化目标。
真·养虾!3步让龙虾边聊边进化,不用GPU不用数据集就能强化学习
程序员给智能体套在线强化学习系统MetaClaw,把用户与AI对话变训练数据。它基于Kimi - 2.5,用SkillRL框架,不依赖本地GPU,训练交Tinker云平台,三步即可上手。