省Token」共找到 708 篇相关文章

开源动态8

AI编程Token消耗降低神器:RTK(Rust Token Killer)实战指南

文章介绍RTK(Rust Token Killer),它能在CLI命令输出到LLM上下文前智能过滤压缩,节60 - 90%Token。文中说明了其原理、特性、压缩策略,还给出安装配置步骤、实测数据及使用建议。

机器学习AI算法工程
开源动态8

Token洪流的转向:当AI Agent成为Token消耗的主宰,什么样的推理服务基础设施才是刚需

Token消耗量转移,AI Agent成Token消耗主宰,大模型推理服务底层逻辑重塑。文章介绍AI Agent时代范式转变、对推理基础设施的需求,还阐述了为其打造的AI Serving Stack架构及优势,它获2025年度相关卓越奖。

AI前线
开源动态8

8K Star!给所有 AI 编程工具加个智能调度中心,节 20-40% Token

AI编程圈火了个工具9Router,它是智能调度中心,能连接主流编程工具,自动路由到40多家AI提供商和100多个模型,自带RTK Token器,还有实用的三级降级机制,安装配置简单。

开源星探
新闻资讯7

黄仁勋要发Token当工资!硅谷兴起刷量大赛,一人一周烧掉33个维基百科

硅谷兴起Tokenmaxxing(Token刷量大赛),AI公司追踪员工token消耗,招聘、考核都与token相关。风投者费用半年内从月付200美元涨至年烧10万。黄仁勋提议用token作薪酬,同时也有对刷量竞赛的质疑。

量子位
新闻资讯7

Token 降价的尽头,是一度电的账

AI进入算账阶段,Token成本成系统工程。优刻得董事长季昕华认为Token终局是电力,降本需选好数据中心、用国内模型等。企业要解决AI投入产出衡量问题,Token需求会持续增长,优刻得定位中立服务平台。

InfoQ
算法论文8

Tokenizer时代真要来了?Mamba作者再发颠覆性论文,挑战Transformer

Mamba作者之一Albert Gu参与的论文提出分层网络H - Net,用动态分块取代tokenization。Tokenization虽能压缩序列但有缺点,H - Net在多方面表现出色,或预示无需Tokenizer训练时代到来。

机器之心
新闻资讯7

刚刚,北京建了一座AI工厂:目标10万P算力,日产10万亿Token

九章云极在2026全球智算科技峰会发布AI工厂战略,含训练和Token工厂,目标10万P算力、日产10万亿Token。用DCU度量投入,Token度量产出,重构智能生产与交付体系,适配不同企业需求。

量子位
产品应用7

Fable 5.1变身Token刺客,几分钟烧光额度!AI圈掀起「榨汁革命」

Anthropic发布的Fable 5.1虽性能强但极耗Token,引发开发者不满。当前AI产业面临算力饥渴与Token通胀问题,企业落地AI痛点多。迅策科技的TokenCloud平台能助力企业高效转化Token,还介绍了其配套产品TokenOS。

新智元
新闻资讯7

都标5美元,账单差三成!OpenAI高管:token从来没法直接比价

OpenAI Codex负责人Tibo指出,不同模型对同一段文字切分的token数不同,即便单token价格相同,最终账单也可能差异很大。他还提到,token无统一计量标准,跨厂商和新旧模型计数都难通用,真正重要的是每次成功结果的成本。

新智元
算法论文8

阿里+清华发现80/20法则:LLM只靠20%的token就能学会Reasoning

阿里与清华研究发现,训练大语言模型(LLM)推理时,真正关键的是20%的高熵token,其余80%低熵token几乎无用。仅用20%高熵token做强化学习,效果超全量训练,还提出RLVR训练策略提升效率。

深度学习自然语言处理