Transformer专用芯片」共找到 916 篇相关文章

开源动态7

Meta没做的,英伟达做了!全新架构吞吐量狂飙6倍,20万亿Token训练

英伟达发布全新架构9B模型NVIDIA Nemotron Nano 2,以Mamba - Transformer混合架构实现推理吞吐量最高提升6倍,对标Qwen3 - 8B并在多任务中表现持平或更优,还开源模型及大部分预训练数据。

新智元
新闻资讯7

他想让TPU成为AI界的X86!

2026世界人工智能大会期间,中昊芯英主办分论坛,新一代全自研TPU架构AI芯片“须臾®”亮相,华东地区首个国产TPU智算千卡集群落成。“须臾®”算力强、成本低,集群全链路国产化,中昊芯英探索TPU突围路径。

芯师爷
新闻资讯7

软件不再卖给人,而是智能体!900 亿风投教父摊牌:Cursor 要“死”了,英伟达遇劲敌

900亿风投教父Jerry Murdock在播客中分享投资经验,指出软件采购将转向智能体主导,Cursor产品显过时,开源社区和ASIC芯片将冲击英伟达,AI或替代白领岗位,强调适应变化对企业和投资者很重要。

InfoQ
8

源神!Twitter推荐算法被马斯克悄悄开源了

马斯克将X平台(原Twitter)「为你推荐」信息流算法开源,不到一天冲到5000 Star。该算法将站内与站外内容合二为一,用基于Grok的Transformer模型统一排序,移除手工特征与大部分启发式规则。

PaperAgent
新闻资讯7

编程超越 Gemini 3 Pro?GLM-5 性能实测对齐 Opus 4.6,智谱市值突破1700亿港元

临近春节,智谱AI发布最新旗舰大模型GLM-5,其代码和智能体能力表现出色,在多方面逼近Claude Opus 4.5,性能超Gemini 3 Pro。该模型已开源,依托国产芯片部署,不过受算力限制,将逐步向用户开放。

AI前线
推荐文章7

大模型的第一性原理:(二)信号处理篇

本文从信号处理角度解读大模型原论文,探讨语义向量化原理,分析 Transformer 与 Granger 因果关系。指出大模型输入 Token 语义嵌入是将自然语言处理转化为信号处理问题,向量化与信号处理、信息论联系紧密。

机器之心
新闻资讯8

马斯克「脑机第一人」首爆!不开颅在线升级,永生代码已写入

Neuralink首位人类受试者Noland Arbaugh自曝大脑芯片更新方式和特斯拉类似,可在线升级。如今奥特曼入局,其参与创立的Merge Labs获2.52亿美金种子轮融资,要做更大规模脑机接口。

新智元
新闻资讯7

21亿,寒武纪“平替”买下一家上市公司

8月27日,寒武纪股价超贵州茅台成A股“新股王”,上半年营收大增且扭亏。同时,芯片行业掀起并购潮,中昊芯英拟21.2亿收购天普股份约50.01%股份,或因对赌协议借壳上市,引发上交所关注。

芯师爷
算法论文8

腾讯混元 TurboS 技术报告首次全公开:560B 参数混合 Mamba 架构,自适应长短链融合

日前腾讯混元 TurboS 技术报告全公开。它是超大型 Hybrid Transformer - Mamba 架构 MoE 模型,有自适应长短思维链机制,总参 560B。在多榜单成绩亮眼,多语种和多任务处理能力强,还介绍了核心创新、训练策略等。

InfoQ
产品应用7

“客户测950,不到一周下单了”,DeepSeek V4 逼出昇腾真功夫

昇腾计算业务副总裁张良透露昇腾近期销量好、认可度提高,大量客户基于其做训练。DeepSeek V4 考验昇腾,其超节点产品均支持。昇腾还对芯片体系和软件栈升级,拒绝仿 CUDA,坚持自主构建生态。

AI前线