「算力资源」共找到 1127 篇相关文章
首次综述「边-云协同计算」,分布式智能与模型优化的最新进展
边缘 - 云协同计算整合边缘节点和云端资源,解决传统云计算问题。最新综述论文系统梳理其架构设计、模型优化等方面,提出统一框架,还指明未来研究方向,如大语言模型部署、6G整合等。
AICon上海演讲精华回顾:《GMI Cloud 全球化高性能分布式推理服务构建实践》
AICon2025上海站,GMI Cloud资深架构师Frank Lee分享《GMI Cloud全球化高性能分布式推理服务构建实践》,介绍其推理平台,拆解扩缩容等能力,分享架构设计、部署及优化实践,揭秘推理提效关键路径。
万字长文!大模型(LLM)推理优化技术总结(非常详细)
文章聚焦大模型推理优化技术,介绍推理过程分预填充与解码阶段,还阐述模型并行、注意力机制优化、模型优化及服务技术等,如多查询注意力减少内存,FlashAttention 优化计算顺序。
77万人围观的吉卜力风「游戏」视频,我们用3个国产AI整出来了(含提示词)
Reddit上吉卜力风格游戏视频爆火,a16z合伙人Justine Moore转发获超77万浏览量。文章介绍用国产AI复刻视频的流程,包括用即梦3.0文生图,对比即梦3.0 Pro、可灵2.1大师版、Hailuo 02视频生成效果,还探讨AI对游戏产业的影响。
10步优化超越强化学习,仅需1条未标注数据!后训练强势破局
无监督的熵最小化(EM)方法仅需一条未标注数据和约10步优化,就能显著提升大模型在推理任务上的表现,甚至超越依赖大量数据和复杂奖励机制的强化学习(RL)。EM为大模型后训练提供了更高效简洁的新思路。
北京芯片巨头,吸金50亿加速狂奔
AI算力需求爆发,4月30日寒武纪抛出近50亿定增计划。其此前多次募资,虽长期亏损,但连续两季盈利,股价涨幅大。当下英伟达限售,政策支持,寒武纪有望抢占市场,此次募资将完善产品矩阵。
Meta首个Agent生图模型登场,空降竞技场第二
Meta超智能实验室推出图像生成模型Muse Image,引入智能体机制,能编写代码、网络搜索,有自主修正能力,支持算力扩展、多轮编辑与画面合成。还预览了Muse Video,两模型均与Meta产品深度整合。
豆包要收费了:三档订阅最贵500元/月,保留免费基础版
五一假期时,豆包要收费的消息冲上热搜。苹果App Store已现订阅服务声明,分三档,最贵500元/月,目前仅测试,正式上线会发完整信息,且保留免费版。豆包APP日活、用户新增和规模都断层领先。
“为了一个功能,需要再造一个Google!”Jeff Dean最新对话:TPU的诞生,与那些差点把服务器烧了的疯狂往事
在Google Cloud Next上,Jeff Dean和Amin Vahdat分享了Google算力帝国崛起秘史。从TPU诞生背景,到自研硬件血泪史,再到软硬件协同设计,还探讨了AI未来瓶颈,如能源、硬件等,以及代码编写现状。
OpenAI急眼了!四页密信怒撕Claude,80亿营收全掺水
OpenAI首席营收官Denise Dresser发四页内部备忘录,向员工发出「决战动员令」,要从「卖产品」转向「做平台」。备忘录火力全开,抨击Anthropic,还急着与微软划清界限,将亚马逊视为重要伙伴。此外,还曝光了接下来90天要做的五件事。