在离线混部」共找到 8177 篇相关文章

开源动态8

SGLang Team: 96 个 H100 GPU 上部署具有 PD 分解和大规模专家并行性的 DeepSeek

本文介绍 SGLang 团队 96 个 H100 GPU 上部署 DeepSeek 的方法。利用 PD 分解和大规模专家并行性,SGLang 实现高吞吐量,成本低。博客探讨并行设计、优化方法,所有组件开源,也指出了当前局限与未来方向。

GiantPandaLLM
产品应用7

保姆级教程!DeepSeek V4 可 Claude Cowork 直接调用,无需订阅免登录且保留完整体验

DeepSeek V4可Claude Cowork直接调用,无需订阅免登录。介绍了接入后能获得完整桌面端体验,还给出获取DeepSeek API Key、开启开发者模式等完整配置方法。

AI寒武纪
推荐文章8

谷歌 Cloud AI 总监 14 年血泪复盘:AI 时代工程师不可替代的 5 类能力,代码反而排最后

谷歌 Cloud AI 总监 Addy Osmani 复盘 14 年谷歌职场,指出大厂代码非决定工程师发展的关键,分享 21 条心得,如用户至上、携手求真等,助工程师少走弯路。

InfoQ
算法论文8

ICLR 2026|原生多模态推理新范式ThinkMorph ,让文字与图像统一架构中共同演化

NUS、ZJU 等联合提出「ThinkMorph」,主张文字与图像统一架构「原生协作」。仅用 2.4 万条数据微调 7B 统一模型,视觉推理平均提升 34.74%,多项任务比肩或超 GPT - 4o 和 Gemini 2.5 Flash,还涌现新能力。

机器之心
新闻资讯7

王田苗三问具身大牛:大模型还「拨号上网」,机器人靠什么拿下真实订单?| WRC 2026

2026世界机器人大会的圆桌论坛上,王田苗向具身智能头部企业CXO抛出尖锐问题。嘉宾围绕量产卡点、大模型应对物理世界不确定性及产业终局生态展开讨论,并就商业化落地节奏达成共识。

AI科技评论
推荐文章8

“大脑硅谷,身体全靠中国!”机器人泰斗揭秘真相:后空翻只是杂耍,端起咖啡才是真AI

最新一期播客中,机器人学泰斗 Sergey Levine 与 Ryan Peterman 深度对话,触及行业焦点如机器人发展阶段、波士顿动力淡出原因等。他强调,机器人技术尚处底层搭建期,需重视先验知识、软硬件结合,跨越鲁棒性门槛。

AI科技大本营
产品应用8

GPT-5败下阵,这款中国AI拿下全球第一,众多医生已用它做诊断

国家卫健委推进“人工智能+基层应用”,基层医生需实用AI助手。未来医生AI工作室的MedGPT临床“安全”与“有效性”评测击败国际知名大模型夺冠,其两款助手获医生认可,被视为AI赋能基层医疗最佳实践。

量子位
新闻资讯7

创新中心 | 2025首届“幻镜”AI视听测评季成果京发布,探索AI视听领域建立科学测评体系

2025年10月28日,“人工智能赋能精品创作沙龙”暨首届“幻镜”AI视听测评季成果发布会京举办,活动旨为AI视听领域建科学测评体系。会上公布测评结果、优秀作品片单,发布研究分析报告。

郎园Station
新闻资讯7

GPT-5最大市场印度?Altman最新访谈:可以聊婚姻家庭,但回答不了GPT-5为何不及预期

2025年8月8日OpenAI发布GPT - 5引发热议。虽受部分用户质疑,如反应慢、回答不准确等,但企业级市场反馈良好。OpenAI CEO Sam Altman访谈中谈其特性、应用等,还探讨AI对各领域影响及社会问题。

AI前线
新闻资讯7

「一脑多形」圆桌:世界模型、空间智能具身智能出现了哪些具体进展?|GAIR 2025

第八届GAIR全球人工智能与机器人大会“数据&一脑多形”分论坛的圆桌论坛上,高飞、金鑫、王靖博三位学者围绕具身智能、空间智能、世界模型等话题展开讨论,探讨研究进展、挑战与机遇,还谈及创业和数据获取等问题。

AI科技评论