高带宽域架构」共找到 3509 篇相关文章

产品应用8

全网首测!首款国产GPU「AI算力本」现场上手

新智元报道首款国产GPU「AI算力本」MTT AIBOOK,它搭载国产全功能显卡,预装开发环境,打破系统壁垒。其背后的MUSA架构全栈自研,软件升级、有翻译工具,硬件架构革新,还有开源计划,产品应用广泛。

新智元
推荐文章8

龙虾安全被3层硬核架构焊死了!一份面向开发者的硬核生存指南

随着OpenClaw等权限智能体应用爆发,AI自主性与失控的赛博博弈开启。文章从源头对齐、边界重构、结果保障三个维度,拆解适应智能体自主行动时代的新型安全框架,为开发者提供生存指南。

量子位
算法论文8

ICML spotlight | 一种会「进化」的合成数据!无需上传隐私,也能生成质量垂域数据

大模型发展使数据短缺问题加剧,特殊领域更严重。为此提出合成数据自主进化框架PCEvolve,只需少量标注样本,就能在保护隐私同时进化出数据集,还介绍了其架构、选择器设计及实验结果。

机器之心
推荐文章8

NVIDIA技术沙龙 《大规模EP优化:PD分离MoE并行方式》课程笔记

本文是NVIDIA技术沙龙课程笔记,介绍大规模EP优化的PD分离MoE并行方式。涵盖PD分离、大规模专家并行等五项关键技术创新,还对比多模型架构,展示推理服务架构性能特点与优化策略,以及各技术工作流程和效果。

GiantPandaLLM
开源动态8

狂涨34.6K star!!再见了Salesforce,开源CRM新标杆,颜值、功能全,太6了!

传统CRM系统价格、生态封闭、操作复杂,而开源项目`Twenty`致力于打造现代化、灵活且度可定制的平台。它功能强大,如可视化流程管理、强大的客户管理等,还提供多种安装方式。

开源先锋
新闻资讯8

刚刚,英伟达新模型上线!4B推理狂飙53倍,全新注意力架构超越Mamba 2

Jet - Nemotron是英伟达推出的小模型系列(2B/4B),由全华人团队打造。其提出PostNAS与JetBlock,实现架构优化。相比Qwen3等模型,它在多维度准确率更,H100 GPU上推理吞吐量最提升53倍。

新智元
推荐文章7

将思维链(CoT)引入具身世界,哪种路径能真正打通机器人「知行合一」?

文章围绕将思维链(CoT)引入具身智能领域展开。介绍CoT从语言层面到成为机器人行为核心认知机制的转变,分析分层架构与端到端模型两种技术路径,还阐述自变量机器人统一架构的优势和能力。

AI科技评论
新闻资讯7

硅谷CEO们喊AI威胁论,「5年内失业率飙升至20%」,但95%AI项目赔本赚吆喝

当下‘AI 威胁就业’论调甚嚣尘上,如Anthropic等公司管预测失业率飙升。耶鲁大学论文分析AGI经济中人类劳动地位。但MIT报告显示,95%公司AI项目未获商业回报,多数试点停滞。

机器之心
新闻资讯7

新易盛股价飙30倍,实控人先跑了

新易盛三年股价翻近30倍,被称“牛市旗手”。但实控人管却不断减持,光荣还遭监管处罚。同时公司应收账款、存货膨胀,现金流有缺口,且九成收入来自海外,“国内AI红利”故事存疑。

芯师爷
算法论文8

ICLR 2026 Oral|中科院团队提出新框架「SparseRL」,深度强化学习可自动生成性能CUDA代码

中科院计算所团队提出 SparseRL 框架,将深度强化学习引入稀疏 CUDA 代码生成任务。实验显示,在 SpMV 任务上编译成功率提升 20%,执行速度提升 30%。该成果已入选 ICLR 2026 Oral。

机器之心