「端侧AI芯片」共找到 10003 篇相关文章
谷歌新论文把内存股价干崩了!KV cache压缩6倍,“谷歌的DeepSeek时刻”
谷歌研究院推出TurboQuant压缩算法,可将AI推理中最吃内存的KV cache压缩至少6倍且精度零损失,还能8倍加速计算。虽引发存储芯片巨头股价下跌,但目前只是实验室成果,仅解决推理阶段内存问题。
5月半导体产业涨价信息全景图!
2026年半导体行业涨价潮席卷全产业链,受AI超级周期与上游金属成本高企影响,存储芯片、MCU等器件及代工、封测服务等均涨价。文章梳理开年至今行业涨价信息,还分析原因及对终端市场的影响。
解码加速15倍!EdgeRazor助推大模型在PC/移动端“狂飙”
大语言模型参数膨胀,端侧部署难,量化成主流轻量化方案。开源工具库EdgeRazor由南京大学和微软联合推出,采用MPQAD打破极低比特大语言模型“能力塌陷”,在性能、效率、易用性等方面表现出色,打通AI全生态链路。
开门红!首钢园中关村通力进入首批“国家级科技型企业孵化器”公示名单
近日,落户北京首钢园的中关村通力科技孵化器入选工业和信息化部科技型企业孵化器(第一批)名单。它聚焦芯片等根技术,已孵化超300家企业,融资超百亿。未来将定位‘AI原生孵化器’,构建全栈赋能生态。
机器狗翻了个身,国产GPU往前走了坚实一步|甲子光年
5月18日摩尔线程发布会上,机器狗“小飞”侧空翻,是业内首次基于国产硬件仿真平台训练、国产端侧芯片部署并真机验证。该司以全功能GPU打造国产具身智能基础设施,MT Lambda平台解决多方面问题。
三家中国工博会参展商,在半导体两场革命中改写格局
2025中国工博会首设集成电路展区,超90%为专精特新企业。在CES 2026上,曾参展的中国展商再登场。瑞芯微、新思科技、移远通信携方案突围,参与半导体算力与场景创新两场变革。
DeepSeek刚提到FP8,英伟达就把FP4精度推向预训练,更快、更便宜
DeepSeek提及针对国产芯片的FP8量化设计,引发对大模型量化策略关注。不久后英伟达发力低精度量化,将NVFP4策略拓展到预训练阶段,其方案能解决核心挑战,实验证明NVFP4在大规模训练中可行。
存储大繁荣:盛宴与倒计时
AI带动存储行业繁荣,三星、美光、SK海力士一个月内登顶万亿美元市值,终结旧周期格局。中国长江存储和长鑫科技崛起,补全产业链拼图。但行业新旧范式切换,周期未终结,各方需应对挑战。
高管0份!影石年会5套房全归90后;34岁清华学霸28个月造百亿独角兽;DeepSeek“冷漠”争议,春节要燃回来?| Q资讯
本文为AI行业资讯汇总,包含DeepSeek回应“变冷漠”、影石年会送房、34岁清华学霸造百亿独角兽等热点,还涉及字节跳动、谷歌、英伟达等公司动态,以及模型下架、新规发布等消息。
上交大和辉羲把LLM刻进ROM!推理性能冲2万token/s,GPU时代终结?
硅谷Taalas将大模型‘物理焊死’进芯片引关注,而上海交大、辉羲智能与微软亚洲研究院团队用ROM+SRAM异构架构,将端侧LLM推理速度推至20,000 tokens/s。介绍了ROMA和TOM架构优势及应用场景。