「大规模训练」共找到 2306 篇相关文章
刚刚,OpenAI花470亿大规模回购股票,高管火速跳车离场!
OpenAI花70亿美元从员工手中回购股份,交易估值8520亿美元。公司6月已提交IPO申请,但此举或意味着上市推迟。同时,多位高管离职,包括伦理负责人,且无继任者。外部竞争加剧,Anthropic势头强劲。
揭秘!腾讯如何训练多智能体像专家一样设计游戏场景
腾讯游戏提出游戏场景自动布局生成系统IntelliScene 2.0,利用图像引导生成3D场景。它构建多智能体工作流,结合高质量数据集,经模型微调、视觉解析等步骤生成场景,经评估效果良好,为AI生成三维信息提供新路径。
DeepMind科学家惊人预测:AGI在2028年实现,大规模失业要来了
Google DeepMind首席AGI科学家Shane Legg预测,最小AGI有50%概率在2028年实现,完全AGI将在其后3 - 6年出现,最终会诞生超越人类的ASI。这将带来变革,也引发失业担忧,需提前准备。
Ilya 最新访谈,预训练时代终结后,AI行业来到了哪里?
Ilya接受90多分钟深度访谈,指出当前大模型泛化能力远不如人,Scaling时代终结,研究时代回归。还谈到AI经济影响与跑分不匹配、泛化能力鸿沟、情感价值等问题,预测超级智能5 - 20年到来。
Lady Gaga进军AI生物科技:用“活体皮肤”训练模型,筛选抗衰老成分
当地时间8月21日,美国歌手Lady Gaga公开参与创办的生物技术公司Outer Biosciences及核心平台Yuna,该司用机器学习等结合离体人体皮肤,从海量化合物中找新护肤成分,已融资约2300万美元。
硅谷今日最热具身模型!不用后训练,看一遍就学会
北美具身初创Skild AI发布全新机器人基础模型S1,主打上下文学习,能看示范视频完成复杂操作。在未见过任务上成功率达66%,远高于传统方法。其发展或让开发机器人技能像给ChatGPT写Prompt。
大规模工程支撑场景下的多智能体系统设计:Grab 实践案例
Grab分析数据仓库(ADW)团队推出多智能体AI系统,处理数据仓库故障排查等工程请求,减少重复性运维。团队搭建多智能体架构,整合工具生态,考虑安全治理,解决上下文管理挑战,提升工作效率。
LinkedIn 重构服务发现:在大规模环境中用 Kafka 和 xDS 取代 Zookeeper
LinkedIn 工程博客中,Bohan Yang 介绍升级基于 ZooKeeper 的传统服务发现平台项目。因传统系统有扩展性问题,团队开发新架构,分离读写路径,实施双读双写机制,迁移后数据传播延迟显著改善。
DeepSeek开源MoE新利器LPLB:基于线性规划,专攻训练动态负载不平衡
DeepSeek在GitHub开源LPLB,这是基于线性规划的并行负载均衡器,用于优化MoE模型专家并行工作负载分配。它通过动态重排序、副本构建等机制实现动态负载均衡,支持多种拓扑结构,但也存在成本估算等局限性。
Karpathy「疯狂之作」:100美元、4小时,就能训练你自己的「小型GPT」
AI传奇人物、前特斯拉AI总监Karpathy推出开源项目「nanochat」,以不到8000行代码复现ChatGPT全流程,只需一台GPU、约4小时、成本仅百美元。项目在GitHub上线不到12小时获4.2k星标。