新闻资讯8
xAI Grok 4 Fast:少用 token 追平 Grok 4
InfoQ
AI 摘要
xAI 推出 Grok 4 Fast,少用 40% token 追平 Grok 4,运行成本降 98%。有 200 万 token 窗口,多平台可用,部分免费,成高性价比替代方案,利好开发者与企业。
阅读原文 · InfoQ
xAI 新模型 Grok 4 Fast 卷疯了!少用 40% token 还能追平 Grok 4,限定范围可直接免费用
近日,马斯克旗下 xAI 推出新 AI 模型 Grok 4 Fast,将非推理与推理能力整合,少用 40% token 追平 Grok 4,运行成本降 98%。它有 200 万 token 窗口,多平台可用,部分范围免费。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
新闻资讯7
OpenAI高管:token比价不靠谱
OpenAI Codex负责人Tibo指出,不同模型对同一段文字切分的token数不同,即便单token价格相同,最终账单也可能差异很大。他还提到,token无统一计量标准,跨厂商和新旧模型计数都难通用,真正重要的是每次成功结果的成本。
新智元
新闻资讯7
五源:后Scaling Law时期AI观察与企业进展
文章是五源2026年第二季度回顾,涵盖对AI多方面观察,如token军备竞赛、模型资产价值、公司组织成护城河等,还提及被投企业上市、融资情况及五源资本获多项行业荣誉。
五源资本 5Y Capital
开源动态7
Netflix开源Headroom,省token效果遭质疑
Netflix工程师Tejas Chopra开源Headroom,定位为AI Agent的上下文压缩层,压缩工具输出等内容,有可逆压缩等特性。官方数据显示节省token效果好,但微软工程师实测结果中性偏负面。
AI工程化
推荐文章8
翁荔:揭秘大模型训练Scaling law
北大毕业的前OpenAI高管翁荔(Lilian Weng)的《Scaling Laws, Carefully》值得一读。Scaling law是预训练预算表,能帮少烧错钱。文章探讨大模型训练预算分配,分析Kaplan和Chinchilla结论差异及数据稀缺问题。
PaperAgent