「混合推理方案」共找到 2924 篇相关文章
华为算力“公共事业”:“超节点+全栈开源”如何撬动AI未来?
文章围绕华为算力“公共事业”展开,介绍其“超节点 + 全栈开源”模式。华为通过推出系列算力芯片、构建“超节点 + 集群”方案、全面开源开放软硬件等举措,满足全球产业算力需求,推动AI产业变革。
重磅团队领衔,国内首部人工智能软硬件跨境数据标准启动编制!
随着AI技术发展,智能软硬件跨境数据流动频繁,数据合规问题凸显。国内首部《人工智能软硬件跨境数据合规指南》团体标准启动编制,以大厂经验为蓝本,提供可落地方案,解决实操难题。
昇腾+鲲鹏联手上大招!华为爆改MoE训练,吞吐再飙升20%,内存省70%
最近华为在MoE训练系统给出算子和内存优化新方案,三大核心算子全面提速,系统吞吐再提20%,Selective R/S实现内存节省70%,为大规模MoE模型训练扫清障碍。
美团开源Agentic新王,速度拉满,工具调用打爆Kimi?
周末美团开源LongCat - Flash大模型,参数量560B,推理速度达100 token/s,成本低,在Agent工具调用表现超Kimi - K2。它有Zero - Computation Experts和ScMoE创新,不过市场表现未获太多认可。
2026具身智能数据赛道,卷出了一匹「黑马」
在具身智能面临数据掣肘的背景下,觅蜂科技宣布2026年4月16日将在上海举办一站式物理AI数据服务平台发布会,展示全栈方案,解决核心痛点,发布会有诸多看点,还将举办高规格圆桌论坛。
这个春节P图不求人!小红书开源图像编辑新SOTA
今日小红书基础模型FireRed - Image - Edit亮相,在复杂编辑指令、风格化转换等核心指标表现强,在多项权威测试达SOTA。该项目代码等已开源,模型权重将开源。团队还推出RedEdit Bench评测方案。
从「知题」到「知人」:UserRL让智能体学会「以人为本」
大语言模型距成真正用户伙伴缺‘知人’能力。来自UIUC与Salesforce团队提出UserBench和UserRL方案。前者将‘用户特性’制度化,构建评测环境;后者搭建统一强化学习框架,探索奖励建模,二者让‘以用户为中心’落地。
Karpathy刚进Anthropic,转头又投了它
AI初创公司Engram成立8个月,估值达6亿美金,获9800万美元融资。它聚焦AI记忆,用Cartridges技术降内存、提速度,将推理和记忆层拆开,团队成员背景强大,押注AI范式新转向。
14.7M参数,小目标AP达到13.9%!FSDETR用频空融合重新定义目标检测
传统小目标检测问题多,2026年4月FSDETR论文提出频空融合法,用14.7M参数获13.9% APS成绩。它有SHAB、DA - AIFI、FSFPN三个核心模块,还给出训练、推理及导出ONNX部署代码。
告别噪声初始化:NTU MARS Lab提出A2A新范式,实现机器人高性能单步动作生成
新加坡南洋理工大学 MARS Lab 提出 Action-to-Action (A2A) Flow Matching 新范式,以历史机器人轨迹为生成起点,打破生成速度与精度瓶颈,在训练效率、推理速度及泛化表现上佳,还可扩展至视频生成领域。