「算力性能」共找到 2562 篇相关文章
当AI应用都在「撒钱」时,谁来扛住千亿交互背后的算力大考?
春节将至,AI应用竞争激烈,各大厂商纷纷「撒钱」。行业预测除夕当晚主流AI应用交互量或破千亿次,考验底层算力。Remy爆火时,共绩科技助其扛住流量冲击,其弹性算力调度优势明显,适合春节流量洪峰。
马斯克22万张GPU全卖给Claude用:5小时限额翻倍,双方合作建太空算力
马斯克和Anthropic签署算力合作协议,将旗下Colossus 1超算集群全部给Claude用。此前马斯克抨击过Anthropic,合作后态度转变。此交易或改写AI算力格局,且三家计划IPO的公司故事也因此改写。
Sora 为什么输给 Codex?
本文探讨Sora输给Codex的原因。奥特曼称因Sora太吃compute,Codex优先级更高。Sora算力连续独占,成本难摊薄;Codex算力碎片可复用,能交错服务多任务,资源回报曲线更好。
DeepSeek-V4发布!高效百万上下文智能普惠时代来了
DeepSeek-V4发布,是开源社区关键分水岭。它解决超长文本处理效率痛点,架构与优化有多项突破,降低算力消耗和成本,适配国产芯片,性能比肩顶级闭源模型,推动开源社区两大未来趋势。
国产GPU又杀出一匹黑马!成立不到一年,两款芯片量产落地
在国产算力从‘技术可用’向‘场景好用’转型时,成立不到一年的芯桥半导体携Sinexus X200、S200系列国产高性能GPGPU产品杀入战场,构建全栈式解决方案,适配多行业场景。
Llama 4造假丑闻幕后:小扎豪赌143亿,却为中国AI「做了嫁衣」
Meta的Llama 4评测性能造假,OpenAI算力计划引恐慌,全球AI发展陷入困境。中国AI力量爆发,如DeepSeek、MiniMax等,以强大性能、高性价比和商业可持续性满足全球需求,在国际舞台崭露头角。
英伟达力荐,小团队两个月开源一款「光速级」智能体推理引擎
智能体时代算力需求庞大,LightSeek Foundation 小团队 2 个月打造大模型推理引擎 TokenSpeed,有 TensorRT LLM 性能、vLLM 易用性,受英伟达力荐且已开源,为智能体负载提供近「光速级」推理能力。
顶级视频模型半衰期只有 30 天,但生成式媒体 infra 公司的收入却在一年增长了 60 倍
文章聚焦生成式媒体 infra 公司 fal.ai,其借统一 API 和云端平台让开发者高效调用多模态模型。深入分析其成功因素,如早期押注生成式视频、优化算力和成本、构建生态等,还探讨用户使用模式与行业发展趋势。
单机狂飙4万亿参数,国产AI「四大天王」首次合体!这台超节点鲨疯了
国产「四大开源天王」可在单机运行,背后是「元脑SD200」超节点。它有超大显存、高速互联域和超强算力,支持64路本土GPU且可商用。浪潮信息以开源为战略加速大模型商业化落地。
吴恩达最新来信:是时候关注并行智能体了
吴恩达在最新来信中指出,并行智能体正成为提升AI能力新方向,多个agent协作能高效处理不同任务。相比依靠数据和算力提升性能的方法,并行agent提升性能同时无需用户久等,且大模型token成本下降使其可行。