高管出走」共找到 1976 篇相关文章

开源动态8

SGLang Team:在 96 个 H100 GPU 上部署具有 PD 分解和大规模专家并行性的 DeepSeek

本文介绍 SGLang 团队在 96 个 H100 GPU 上部署 DeepSeek 的方法。利用 PD 分解和大规模专家并行性,SGLang 实现吞吐量,成本低。博客探讨并行设计、优化方法,所有组件开源,也指出了当前局限与未来方向。

GiantPandaLLM
算法论文8

DeepMind:Transformer存在拓扑缺陷,思维链治标不治本

谷歌DeepMind论文指出,Transformer架构不擅长追踪状态,思维链只是给结构性缺陷打补丁,成本。论文主张用循环架构替代或补充纯前馈结构,还提出多个研究方向,认为下一代模型需构建‘流动的现实表示’。

机器之心
新闻资讯8

刚刚,马斯克发布Grok-4,在各大基准测试上表现太猛了。

马斯克的 xAI 发布 Grok - 4,在各大基准测试表现出色,如 AIME25 拿满分、GPQA 领先等。第三方测评显示其登顶,编码和数学指数居首。价格与 Grok 3 相同,今日上线但价格,甚至有已售罄情况。

AI进修生
新闻资讯8

宇树上市:王兴兴的十年非共识|甲子光年

2026年宇树科技成功上市,创始人王兴兴创业十年有诸多“非共识”观点。如性能机器人不意味昂贵,堆数据难带来具身智能,AI强对硬件要求或降低。如今宇树成行业共识,也面临新挑战。

甲子光年
开源动态8

M2模型杀回Coding和Agent领域,MiniMax想要「普惠智能」

如今大模型竞争转向综合比拼,MiniMax 发布并开源 M2 模型,在权威测评跻身全球第一梯队。它定位轻量级,Coding 与 Agentic 能力强,性价比,还升级 Agent 产品,以技术普惠策略让用户零成本体验。

InfoQ
开源动态8

月之暗面刚开源多模态Kimi-2506:智能体、视觉理解,重磅大升级

国内月之暗面平台对开源多模态模型Kimi-VL-A3B-Thinking升级到2506版本。该版本性能、视觉理解等能力提升,支持更分辨率,在多领域表现出色,还介绍了模型组成与优化器改进。

AIGC开放社区
算法论文8

华为 IJCAI 2026 论文盘点:从「规模密度」转向「设计密度」

IJCAI 2026将召开,AI算力成本,参数扩张边际收益低,技术创新逻辑转向‘用得更省’。华为四篇被收录论文,用精巧架构和训练策略,在四方向展现系统化工程能力,提供技术转型路径。

AI科技评论
新闻资讯7

DeepSeek V4「满血版」曝光了!最快明天发布

全网等近三个月,DeepSeek V4正式版或最早明日发布。有Flash和Pro两版本,开发者评价其性能接近Opus 4.8,Agent能力增强。首轮测试外流,评价不一。还将引入「峰谷计费」,性价比仍

新智元
推荐文章7

AI产业链投资大逻辑:第六集

本集聚焦AI产业链应用层悖论。应用层离用户近、故事性感,但现阶段易让投资者犯错。虽有诸多火热产品且公司估值,但‘创造价值’与投资者‘以好价格买价值’并非一回事。

newtype AI
新闻资讯7

谷歌、OpenAI同日发布模型,一个最快最具性价比,一个主打「人情味」

深夜谷歌和OpenAI相继推出新版本大模型Gemini 3.1 Flash - Lite、GPT‑5.3 Instant。前者专为大规模智能设计,性价比、速度快;后者让日常对话更稳定实用,减少幻觉,提升了多方面表现。

机器之心