「计算集群」共找到 782 篇相关文章
The Batch: 899 | 更划算的推理
研究人员提出 Delethink 强化学习方法,训练大模型定期截断推理 token 至固定最大数量,以限制处理长思维链成本。经测试该模型在多方面超基线,且缓解计算成本限制,为长上下文推理提供路径。
黄仁勋CMU演讲:取代你的是会AI的人,所有人同一起跑线,奔跑吧
卡内基梅隆大学毕业典礼上,黄仁勋发表演讲。他指出AI不太可能取代人,但善用AI的人可能取代他人。他还提及计算范式转变,新工业带来新潜能,呼吁毕业生全力奔跑塑造未来。
刚刚,DeepSeek 突发梁文锋署名新论文:V4 新架构提前曝光?
今天凌晨,DeepSeek在GitHub开源新论文与模块Engram,论文提出“查—算分离”机制,通过可扩展查找记忆结构提升模型表现。Engram将记忆与计算职责分离,或成V4核心技术,获网友肯定。
xAI联合创始人出走:连马斯克都留不住顶级人才
伊戈尔·巴布什金这位效力过DeepMind和OpenAI的AI老将,助马斯克建成孟菲斯超算集群后离开xAI,创办风投公司“Babuschkin Ventures”,瞄准AI安全赛道,揭示AI行业顶尖人才的追求。
浙商大佬,带出350亿芯片独角兽
68岁浙商大佬王东升二次创业,投身半导体领域。他带领奕斯伟计算,锚定RISC - V指令集砸钱研发,虽三年累计亏损49.5亿,但D轮融资后估值达350亿,还四处扩建朋友圈推动生态建设。
已量产交付!芯桥半导体全栈国产GPU助推智算自主化
芯桥(北京)半导体成立于2025年3月,掌握核心自主知识产权,旗下Sinexus X200及Sinexus S200已量产,产品在多算力集群点亮。X200性能强、价格优,芯桥还提供全栈式解决方案。
卡帕西李飞飞辛顿都投了的Transformer专用芯片,签下10亿美元大单
Etched是只做Transformer专用芯片的创业公司,获卡帕西、李飞飞、辛顿投资。它宣布流片成功,筹集8亿美元,获10亿美元客户大单,还推出一整套面向前沿模型推理的集群系统。
关于多模态大模型Token压缩技术进展,看这一篇就够了
多模态大模型跨模态融合带来高计算成本,催生MLLM Token Compression研究。北大等机构人员基于压缩位置对方法系统归类,讨论特定场景压缩机制选择,还探讨了挑战与前景方向。
DeepSeek-V3.2-Exp:用稀疏注意力打破长文本效率瓶颈
在NLP领域,处理长文本时传统注意力机制效率低。DeepSeek团队推出DeepSeek-V3.2-Exp模型,引入稀疏注意力机制,在保持性能同时提高长文本处理效率,降低计算复杂度,在多基准测试中表现良好。
The Sentient Interface: Art, Technology, and the Expanded Mind
在计算与数据主导的时代,艺术、科学与技术边界渐趋模糊。本次活动汇聚四位从业者,探讨如何将无形元素转化为审美体验,从生态数据到AI叙事,跨越学科探索人机关系与环境依存。