「GPU调度」共找到 539 篇相关文章
北大联合Llama-Factory推出DataFlex:工业级数据动态训练系统
北大张文涛教授、鄂维南院士团队联合多机构推出大模型数据中心动态训练框架DataFlex。它是统一训练基础设施,纳入三类核心能力,解决底层系统问题,在效率和效果上有提升,受社区认可。
字节清华智能体自动写CUDA内核,比torch.compile加速2.11倍
字节Seed与清华AIR团队开源CUDA Agent,在GPU内核优化基准KernelBench上成绩优异。它是大规模智能体强化学习系统,训练数据经多阶段构建,分阶段训练,全面超越商业模型,还开源了训练数据集。
连中摩尔沐曦海光,成都国资赢麻了
摩尔线程与沐曦上市引爆国产GPU赛道热情,其背后均有成都高新区国有资本身影。此前,成都高新区还是海光信息二股东,收获丰厚回报。它通过“以投带引”盘活产业链,推动产业升级。
5Y News|祝贺摩尔线程成功登陆科创板!
2025年12月5日,摩尔线程在科创板上市,成中国首家登陆资本市场的全功能GPU企业。它以自主创新为根基研发芯片,构建起技术体系,商业表现佳,上市募资将投入芯片研发,助力国家数字经济发展。
关键技术详解|腾讯一念 LLM 分布式推理优化实践
InfoQ 邀请袁镱分享《一念 LLM 分布式推理优化实践》。介绍了“一念 LLM”设计思路、推理优化挑战与突破等,还对比不同框架,指出优化方向,如先实现 PP,再推进 EP 与 PD 分离。
刚刚,OpenAI官宣自研造芯,联手博通开发10吉瓦规模的AI加速器
今天凌晨,OpenAI宣布与博通战略合作,共同部署其设计的10吉瓦规模AI加速器,预计2026下半年起部署机架,2029年底完成。此次合作将减少其对英伟达GPU依赖,采用多元化算力策略。
一颗 1.8 纳米芯片,成了英特尔「最后的救赎」
2025年10月9日,英特尔公布基于18A工艺的酷睿Ultra系列第三代处理器Panther Lake。它集成多部件,性能提升大,还将用于机器人等。此前英特尔危机四伏,此产品发布意义重大,成败影响深远。
AI如何重塑大厂成熟业务?百度文库GenFlow打了个样
文章讲述百度文库借助AI从“资源下载站”变为“智能生产力平台”。其转型体现在产品定位重构、挖掘用户需求、跨业务协同。GenFlow2.0打通文库与网盘,提升体验、重塑边界,证明非核心业务也能价值重生。
FriendliAI获2000万美元,以加速AI模型推理工作负载
专注AI推理的初创平台FriendliAI获2000万美元种子扩展轮融资,资金用于加速平台开发。其专有推理优化技术可降低模型运行成本和能耗,能为用户省90%的GPU成本,合作客户广泛。
AI 时代操作系统的三重叙事:技术重构、国产化突围与生态共建
《AI 进化论:智算时代操作系统的破局之路》首期,周明辉、马涛围绕 AI 对操作系统的影响等核心命题展开对话。指出 AI 让操作系统面临挑战,技术演进分两条路径,还谈到安全、国产化、生态共建等问题。