「云端GPU」共找到 516 篇相关文章
Meta详细阐述基于LLM级训练、混合并行计算与知识迁移的GEM广告模型
Meta发布生成式广告模型GEM详细信息,旨在改善平台广告推荐能力。它处理海量用户 - 广告交互数据,用三种方法构建系统,还实施GPU级优化,采用两种知识迁移策略,获业内人士认可。
刚刚,智谱推出全球首个手机通用Agent,人人可用
智谱发布新版AutoGLM,是全球首个手机通用Agent。它为用户配备云端手机,能在不影响用户操作的前提下完成各类任务,还在技术上有重大突破,成本更低,代表全新互联网流量。
芯片巨头终于等来“泼天机遇”
2025年10月6日,AMD与OpenAI官宣6吉瓦GPU算力部署战略合作,有望带来数百亿美元收入。合作通过“算力部署+股权绑定”将双方利益捆绑,对AMD意义重大,但也面临技术、市场、成本等考验。
今天,Claude Cowork大更新!合上电脑,它替你彻夜打工
Anthropic官宣Claude Cowork正式登陆手机和网页端,Chat和Cowork合并成一个入口。Cowork可脱离设备在云端运行,完成工作闭环,还能让用户在看球赛、赶飞机时用手机‘监工’,巨头正抢占普通人办公市场。
揭秘 Uber 跨区域数据湖与灾难恢复机制:350PB 数据、数百万事件、单一系统
Uber构建的HiveSync是分片式批量复制系统,能让Hive和HDFS数据跨区域同步,每天处理数百万Hive事件。它基于Airbnb ReAir扩展,分离控制与数据平面,有复制和数据修复两组件,未来计划拓展到云端。
突发!美国解除封锁,英伟达可向中国销售H20 AI芯片
CNBC消息,美国政府向英伟达保证授予销售许可,将恢复对中国销售H20 AI芯片。此前该芯片受出口管制。黄仁勋加大游说,与特朗普会面后美态度转变,他还宣布新GPU,英伟达财报表现强劲。
关于Nsight Compute中Compute Workload Analysis反映的Tensor Pipe Uti的理解
文章分析Nsight Compute中Compute Workload Analysis反映的Tensor Pipe Uti异常现象。通过实验和推算,发现ncu对L20 GPU上特定指令用错误执行延迟算指标,导致异常,还给出GEMM Kernel性能分析建议。
模型都一样了,AI Agent 真正的差距在 Harness 层!
如今各平台接入模型趋同,AI Agent 差距体现在 Harness 层。以天工超级智能体为例,其有约束先行、任务并行编排等亮点,还提供 Skill 粒度新思路,且云端运行降低使用门槛。
英特尔「亲爹」要买干儿子?CEO陈立武的双重身份藏不住了
英特尔考虑拿下SambaNova,现任CEO陈立武还是SambaNova执行董事长。英特尔此前GPU发展滞后,此次是重新发力AI芯片赛道。SambaNova曾想融资,若被收购估值或缩水,其目标是挑战英伟达。
破解300年数学难题,智能体大突破!谷歌发布超强AI Agent
今天凌晨谷歌Deepmind发布编程AI Agent——AlphaEvolve,它与Gemini深度集成,能评估算法。它解决了300多年的数学难题,还提出新算法,提升大模型计算效率,可优化GPU指令,架构含多模块。