「算力性能」共找到 2562 篇相关文章
OpenClaw烧光全球Token?追觅芯际穿越甩出太空芯,200万卫星叫板马斯克
文章介绍了芯际穿越的业务进展。该品牌规划200万颗算力卫星组成太空算力中心,超越马斯克的SpaceX。其产品涵盖泛机器人、手机处理器、自动驾驶芯片等,踩中国家级复合主航道。
刚刚,马斯克官宣xAI解散,22万张GPU算力租给Anthropic
马斯克官宣 xAI 解散,将整合进 SpaceX 新子部门 SpaceXAI。同时,SpaceX 与 Anthropic 达成协议,超 22 万张英伟达 GPU 算力用于提升 Claude 代码生成,双方合作利好彼此。
装机量超2000万、全球主流GPU与AI框架“开箱即用”!OpenCloudOS成AI时代优先选项
在大模型训练迭代快、算力需求高但 GPU 利用率低、生态碎片化的背景下,2025 OpenCloudOS 操作系统生态大会举办。OpenCloudOS 围绕 AI 升级技术,构建能力闭环,还发布智能基座,降低产业链技术摩擦。
告别盲选LLM!ICML 2025新研究解释大模型选择的「玄学」
弗吉尼亚理工大学研究团队提出 LensLLM 框架,基于 PAC - 贝叶斯泛化界限揭示 LLM 微调性能“双相演进”,可精准预测微调性能、大幅降低计算成本,为 LLM 选型提供新工具。
扎克伯格官宣:要造普罗米修斯计算集群
扎克伯格为实现超级智能目标,打造顶尖团队,投入数千亿美元算力。Meta 有望成首个让超 1 吉瓦超级计算集群上线的实验室,正构建数个多吉瓦计算集群,如 2026 年上线的‘普罗米修斯’。
SGLang × RoleBasedGroup(RBG):打通大模型推理PD分离架构规模化落地的“最后一公里”
PD分离架构对大模型推理部署意义重大,SGLang支持该架构且性能佳。但从测试到生产落地难,存在部署、资源、可靠性等问题。SGLang开源RBG项目,结合二者为PD分离架构生产化落地提供方案。
1000 行 Java 代码手搓 OpenAI gpt-oss 推理引擎
2025年8月OpenAI发布gpt - oss,作者受相关项目启发,用约1000行Java代码实现gpt - oss推理引擎并发布在亚马逊官方github。文章分享开发体会,介绍模型架构、Java实现、性能优化等内容。
微软发布了 TypeScript 5.9,延迟导入并增强了开发者体验
微软发布 TypeScript 5.9,带来开发者体验改进、新特性和性能优化,如支持延迟导入、改进默认项目设置、引入新模块选项等,也有性能升级,还透露未来版本计划。
从 Redis 到 Valkey,开源社区如何快速创新?
文章介绍了开源键值数据库 Valkey,它诞生于 2024 年 3 月,由 Linux 开源基金会托管,完全兼容 Redis OSS 7.2.4。Valkey 版本迭代快、性能提升、云厂商跟进、社区规模增长、迁移成本低。中国开发者在其中贡献突出,Valkey China 公众号也已上线。
ICLR 2025新成果:文档检索“降本增效”,从此“开挂”
传统文档检索系统处理视觉信息丰富的文档存在瓶颈,ColPali方法直接从文档页面图像生成多向量嵌入,简化流程、提高性能、降低延迟。ColQwen - Omni在其架构上扩展到图文+音频多模态匹配。