「中国算力方案」共找到 2366 篇相关文章
8B模型可以超过GPT-4o!并行KV Cache压缩支持的128K长度外推方法ParallelComp
大模型长文本推理存在瓶颈,作者提出 ParallelComp 方案。它有并行 Attention 分块、KV 缓存智能淘汰与注意力偏差校准三大创新,能让 8B 模型性能达 GPT - 4o 的 91.17%,特定任务超 GPT - 4o。
纳米 AI 梁志辉:超级搜索智能体是 AI 时代的真正入口
纳米AI梁志辉认为超级搜索智能体是AI时代真正入口。纳米AI推出的「超级搜索智能体」结合多Agent协作等能力,是新解决方案。演讲分享了360对AI搜索、智能体搭建及浏览器的看法与探索。
传统云还在「卖铁」,下一代云已在「炼钢」:火山引擎xLLM如何一张卡榨出两张的性能!
大模型上线部署时推理成本高、算力投入大但效果不成正比,企业面临推理效率难题。火山引擎 xLLM 大语言模型推理框架性能极致,成本低,集成关键创新,还被集成到 AI 云原生推理套件 ServingKit 中。
180亿深圳芯片黑马,华为猛下单
4月25日晚,云天励飞公告2024年营收超9亿,同比增81.3%,截至4月28日收盘市值超180亿。该公司以‘算法芯片化’为基础,在推理算力、行业赋能、消费级业务均有布局,还与华为等合作。
破除人形崇拜!京东用“狼族”军团重做物理AI
当行业狂热追捧人形机器人时,京东物流针对物流仓储非标环节自动化渗透率低的痛点,推出「狼族」异构机器人集群搭配超脑3.0智能中枢的全链路物理AI方案,已实现规模化落地,兼顾效率与经济性。
50FPS、成本打掉70%,魔芯MoWorld把世界模型带进产业时代
近期,魔芯科技联合浙江大学潘云鹤院士、华为等发布实时交互世界模型MoWorld,推理速度超50FPS,部署成本仅为同规模GPU方案的30%。它全链路优化,将用于多行业,魔芯也完成亿元美金融资。
独家|能量桥完成新⼀轮融资,Monolith领投,中科创星跟投
近日,能量桥完成新一轮融资,由 Monolith 砺思资本领投,中科创星跟投。该公司核心团队经验丰富,其预制化超导能源模块可实现数据中心配电零损耗。在 AI 算力建设背景下,超导技术或成输电破局点。
华创七星微:为直流供电系统筑起一道防火墙
随着AI等领域设备迭代,电源保护重要性凸显。华创七星微依托六类量产芯片和将问世的集成模块,为直流供电系统提供防护,其产品覆盖供电链路关键节点,有完整解决方案,还具备多种能力优势。
AI 的经济账根本算不通
文章指出AI经济账算不通,如GitHub Copilot将按用量计费,此前微软补贴用户算力;AI订阅服务成本波动大,欺骗用户;AI数据中心建设和运营成本高、收入少,依赖少数客户,OpenAI和Anthropic盈利难,可能影响相关企业。
面壁智能完成新一轮融资,26年累计融资超10亿,跻身基模独角兽行列
面壁智能宣布完成新一轮数亿元融资,由深创投和汇川产投领投。今年一季度累计融资超10亿,其获“2026年度中国独角兽企业”称号。各方看好端侧AI,面壁以‘密度法则’构建技术生态,产品应用广泛。