超节点架构」共找到 3770 篇相关文章

推荐文章8

NVIDIA技术沙龙 《大规模EP优化:PD分离MoE并行方式》课程笔记

本文是NVIDIA技术沙龙课程笔记,介绍大规模EP优化的PD分离MoE并行方式。涵盖PD分离、大规模专家并行等五项关键技术创新,还对比多模型架构,展示推理服务架构性能特点与优化策略,以及各技术工作流程和效果。

GiantPandaLLM
新闻资讯7

一个Bug改通宵!用AI写50%代码,只有32%资深开发者敢这么干

Fastly对美国开发者做AI生产力调研,发现高级开发者用AI交付代码量是初学者2.5倍,也揭示AI编码隐形成本。高级开发者更信任AI,而初级开发者因经验不足更谨慎,同时调研还涉及绿色编码认知。

新智元
产品应用7

对话小鹿光年创始人许婷:七成付费人群是子女,AI回忆录的「隔代」生意经

本文是对小鹿光年创始人许婷的访谈。许婷介绍了AI回忆录产品小鹿光年,称七成付费人群是子女。还谈及产品流程、优势、用户画像等,也分享对赛道发展的看法,认为创业者晚几年入局或更合适。

AI科技评论
新闻资讯8

刚刚,英伟达新模型上线!4B推理狂飙53倍,全新注意力架构越Mamba 2

Jet - Nemotron是英伟达推出的小模型系列(2B/4B),由全华人团队打造。其提出PostNAS与JetBlock,实现架构优化。相比Qwen3等模型,它在多维度准确率更高,H100 GPU上推理吞吐量最高提升53倍。

新智元
推荐文章7

将思维链(CoT)引入具身世界,哪种路径能真正打通机器人「知行合一」?

文章围绕将思维链(CoT)引入具身智能领域展开。介绍CoT从语言层面到成为机器人行为核心认知机制的转变,分析分层架构与端到端模型两种技术路径,还阐述自变量机器人统一架构的优势和能力。

AI科技评论
新闻资讯7

国产GPU芯动科技发布最新芯片,单卡直接堆上了112GB以上的大显存

9月22日,芯动科技在珠海正式发布“风华3号”全功能GPU,它有诸多亮点,如集成国产RISC - V CPU与兼容CUDA的GPU、原生支持DICOM显示等,还构建了国产GPU完整生态。

AIGC开放社区
算法论文8

横扫八大数学竞赛:清华微软联合提出STAR-PólyaMath,Apex基准GPT-5.5 13.5%

清华大学与微软亚洲研究院团队提出推理多智能体系统 STAR - PólyaMath,构建探索 - 推理 - 验证框架,解决大模型长程数学推理瓶颈,在八大数学竞赛基准获最优成绩,还可泛化到其他推理场景。

机器之心
推荐文章8

当EDA(消息驱动架构)遇到AI Agent:消息驱动在智能体时代的重生

文章探讨消息队列与AI Agent的融合。回顾消息队列发展历程,阐述多智能体协作系统成为AI落地核心架构的原因,分析消息队列与AI Agent的融合点,介绍Apache Pulsar对AI Agent的赋能,还展望了AI与中间件的双向进化。

AI大模型应用实践
开源动态8

OpenAI携手五巨头开源革命性算协议:一举解决大集群LLM训练不稳定和网络性能难题

OpenAI联合英伟达等五巨头推出算开放网络协议MRC并正式向行业开放。MRC目标是性能可预期,有多平面网络、自适应包喷射、SRv6源路由三大核心机制,已在OpenAI多台级计算机上部署。

AI寒武纪
新闻资讯7

Vercel CEO爆Kimi K2智能体准确率GPT-5 50%?国产的风还是吹到了硅谷

Vercel CEO称内部测试中,国产Kimi K2模型运行速度和准确率均优于GPT - 5和Claude Sonnet 4.5。硅谷多家公司已接入或转用K2,K2 Agent能力也经受住检验,还给出使用和价格相关信息。

AI寒武纪