「云成本」共找到 1913 篇相关文章
AI 的「成本」,正在把所有人都拖下水
文章指出,虽大模型成本下降,但 AI 公司仍难盈利。因市场追逐新模型,且模型消耗算力单位剧增。如 Anthropic 的不限量套餐失败,各公司陷入囚徒困境,还给出按使用量计费等破局思路。
入选 SOSP'25:百度智能云对象存储的分布式层级 Namespace 破解业界难题,彻底扫清 AI 时代大数据上云障碍
百度沧海・存储团队与高校合作的论文被 SOSP'25 录用,介绍了百度智能云对象存储 BOS 的分布式层级 Namespace 系统 Mantle。它攻克业界难题,融合文件和对象存储优势,性能卓越,已在 BOS 生产环境大规模上线超两年。
AI基础架构重大突破,计算成本暴降38倍
Perforated AI团队搞出‘穿孔反向传播’技术,给旧神经元加‘人工树突’。测试中计算成本最高降38倍,模型准确率不降反升,还近乎即插即用。这或引发行业变革,但也面临验证、生态和收费等挑战。
性价比搏击:Grok 4 Fast 推理成本直降 98%
xAI上周五发布旗舰模型轻量化版Grok 4 Fast,推理成本直降98%。它通过强化学习在基准测试表现佳,有原生工具调用能力,采用统一架构,性价比高,或改写大模型竞争规则。
阿里云的“反差”2025:于无声处寻找 ASI
2025年云栖大会上,吴泳铭称实现AGI是确定事件,ASI才是终局。实现ASI需满足两大条件,结合阿里投资计划,阿里云将成企业AI时代支撑者。虽市场份额增长,但利润下降,2025年阿里云极具“反差感”。
云计算一哥,给 Agentic AI 工程做“减法”
2025 年亚马逊云科技 re:Invent 大会聚焦 Agent,其首席执行官提出未来各领域将运行数十亿 Agent。该公司欲在 Agentic AI 上重构,推出系列工具,如 Amazon Strands Agents SDK、Amazon Bedrock AgentCore 等,还在模型训练和工程化方面做减法。
AMD跑GLM 5.2,成本只要英伟达一半
推理优化公司Wafer公布数据,用AMD的MI355X芯片跑GLM 5.2,单节点吞吐达2626 tok/s,单流吞吐213 tok/s,成本不到英伟达B200的一半。该公司详述部署过程,还提及AMD软件生态的变化及英伟达面临的挑战。
1/15成本,实现AI水印新SOTA | 南洋理工大学&A*STAR
给AI生成作品打水印成行业共识,但传统方法有短板。南洋理工大学等机构研究人员提出局部鲁棒图像水印方法MaskMark,成本仅为Meta模型WAM的1/15,在多任务中表现优异。
吴昊:AI 重构 SaaS,成本降百倍需求增千倍
SaaS市场经历‘惊魂六十天’,‘SaaS终结论’甚嚣尘上。但吴昊指出,AI让软件开发成本降100倍、需求增1000倍,会使行业洗牌,旧护城河崩塌,新壁垒出现,企业需转型。
腾讯云TencentOS智能运维平台TManager正式发布 | Q推荐
为满足企业运维需求,腾讯云推出 TencentOS Server 首款智能运维管理平台 TManager。它有 30 余项功能,能 AI 智能诊断,内部稳定运行多年,覆盖复杂场景,还赢得标杆客户信任,提升运维智能化水平。