算力部署」共找到 1407 篇相关文章

开源动态8

中大 × MBZUAI重磅开源!A₁:全透明高效 VLA 模型,机器人实时控制成本直降 76% 丨CVPR 2026 Findings

开放世界机器人操作被大模型算力成本和推理延迟难题困住,中大与MBZUAI团队推出全开源的A₁模型,其自适应推理方案降低推理延迟和骨干计算量,性能超主流基线,打破‘高性能=高成本’魔咒。

AI科技评论
7

英伟达首台DGX GB300,老黄亲自登门送给他

老黄将首台DGX Station(GB300)送给个人开发者卡帕西,还附赠“小作文”。卡帕西打算用它搭建个人AI集群做实验。DGX Station把数据中心级AI算力搬到桌面,英伟达还为此贡献开源堆栈NemoClaw。

量子位
算法论文8

清华新框架让大模型学会「精读略读」!实现12倍端到端加速,基准评分翻倍

清华等团队提出全新框架RAM,受人类阅读认知启发,将“精读+略读”混合策略引入上下文压缩,突破现有方法效率瓶颈,在多任务上表现出色,实现12倍端到端加速,为长上下文LLM部署提供新范式。

量子位
产品应用8

0.3B参数,600MB内存!腾讯混元实现产业级2Bit量化,端侧模型小如手机App

腾讯混元团队推出面向消费级硬件的“极小”模型HY-1.8B-2Bit,参数量仅0.3B,内存占用600MB。它基于产业级2Bit端侧量化方案,生成速度提升,还通过多种方法提升能力,未来将探索新技术缩小与全精度模型差距。

量子位
产品应用7

全球首款120通道PCIe5交换芯片面世,为国产AI基础设施赋能

随着AI算力需求增长,芯动科技推出全球领先的104/120通道PCIe Gen5交换芯片。该芯片功能及性能全面对标国际行业龙头,可适配全场景应用,其落地标志国产高端PCIe交换芯片实现关键跨越。

芯师爷
新闻资讯8

刚刚,微软全新一代自研AI芯片Maia 200问世

微软原定于 2025 年发布的下一代 AI 芯片 Maia 200 问世。它基于台积电 3 纳米工艺,性能强、能效高,是异构 AI 基础设施重要部分,将为多个大模型提供支持,已部署在美国中部数据中心区域。

机器之心
开源动态8

刚刚,DeepSeek 突发梁文峰署名新论文:V4 新架构提前曝光?

今天凌晨,DeepSeek在其GitHub官方仓库开源了新论文与模块Engram。该论文提出“查—算分离”机制,通过引入可扩展的查找记忆结构,在等参数、等算力条件下提升模型表现,代码与论文全文均已开源。

AI前线
新闻资讯8

2年内AI生成世界90%知识!老黄2小时重磅访谈「剧透」未来

新智元报道黄仁勋2.5小时访谈,他透露2 - 3年内90%知识或由AI生成,强调AI尽头是能源,提出通用高收入概念,还分享英伟达危机、童年经历,解答AI意识、失控等问题。

新智元
新闻资讯7

完成20亿的融资,这家AI芯片公司也要冲击IPO

近日,AI芯片企业清微智能完成超20亿人民币C轮融资,已启动上市筹备。该公司是可重构计算领导企业,量产多款芯片,与智源研究院合作打造国产AI芯片软件生态,市场表现佳。

芯师爷
新闻资讯8

92亿美元创纪录营收背后,AMD从英伟达手中“抢”走了什么?|甲子光年

美国当地时间11月4日,AMD公布2025财年第三季度财报,多项数据创纪录,已悄然抢夺英伟达在AI领域市场。其崛起基于GPU、CPU及软件层面战略部署,在中国市场也有独特策略,但转型仍面临风险。

甲子光年