「CPU运行」共找到 631 篇相关文章
刚刚,Anthropic年化营收突破650亿美元!冲刺史上最大IPO
据彭博社报道,截至今年7月底,Anthropic年化营收运行率达650亿美元,数月间增长至原来7倍多,Q2初步收入是去年同期约14.6倍。其正向调整后营业利润显现经营杠杆,或10月上市,估值超2万亿美元。
内存一年疯涨170%,云账单里的“隐性成本”该算清了
2025年下半年存储价格成焦点,DRAM合同价同比涨幅达171.8%,致企业IT采购成本上升。华为云更新Flexus云服务器系列,基于柔性算力技术,打破CPU与内存固定绑定,减少浪费,还引入应用级加速,提升性能。
92亿美元创纪录营收背后,AMD从英伟达手中“抢”走了什么?|甲子光年
美国当地时间11月4日,AMD公布2025财年第三季度财报,多项数据创纪录,已悄然抢夺英伟达在AI领域市场。其崛起基于GPU、CPU及软件层面战略部署,在中国市场也有独特策略,但转型仍面临风险。
断网可用!首款全双工全模态大模型技术报告发布,附一键安装包
面壁智能等联合发布MiniCPM-o 4.5技术报告,它是业界首个端到端全双工全模态大模型,采用Omni - Flow架构。同步推出在线Demo、API、端侧安装包等,低显存GPU即可运行,性能表现优秀,应用潜力大。
32个随机数字,1分钟推演地球未来15天丨谷歌DeepMind
谷歌DeepMind发布WeatherNext 2,运行速度比上一代快8倍,分辨率达小时级。其关键是新提出的FGN功能生成网络,通过输入32个随机数字生成多样天气情景,速度快且准确率高,虽有小瑕疵但实用。
The Batch: 948 | GLM 5.1:面向长时任务的能力提升
Z.ai将旗舰开源权重大语言模型升级为GLM - 5.1,可在单个任务自主运行八小时。它专为编程和智能体任务设计,有推理等特性,在多榜单表现佳,但推理和数学能力落后闭源模型,价格有提升。
GPU到底是如何工作的?这篇AI Infra入门全部告诉你
本文详细介绍了GPU工作原理及编程模式。它从图形渲染发展到GPGPU,NVIDIA推动其通用计算。还阐述了CPU/GPU异构架构,对比二者性能,介绍编译、加载、启动过程,以及GPU硬件架构、编程与执行模型,分析SIMD和SIMT。
小红书 FinOps 实践:云成本优化与资源效率提升之道
在 InfoQ 举办的 QCon 全球软件开发大会上,小红书梁啟成分享云成本优化实践。介绍了小红书用云情况,分析成本优化面临的问题,阐述成本洞察和优化的探索,如内外账分离、CPU 和 GPU 资源提效等,还展望了 AI for FinOps 实践。
黄仁勋手撕「AI泡沫」论!英伟达570亿铁拳暴击,显卡全断货
英伟达Q3 2026财报显示单季度营收达570亿美元,数据中心业务同比狂涨66%。黄仁勋称AI不是泡沫,而是计算范式从通用CPU转向加速式GPU计算的必然。当前多数AI公司估值高、收入低,英伟达作为‘卖铲人’大获全胜。
腾讯混元开源 4 个小尺寸模型,主打 Agent 和长文
8月4日,腾讯混元开源四款小尺寸模型,参数为0.5B、1.8B、4B、7B,消费级显卡可运行,适用于低功耗场景。模型具备推理快、性价比高特点,亮点是Agent和长文能力,已在腾讯多业务应用。