低token高压缩」共找到 1707 篇相关文章

新闻资讯7

刚刚,北京建了一座AI工厂:目标10万P算力,日产10万亿Token

九章云极在2026全球智算科技峰会发布AI工厂战略,含训练和Token工厂,目标10万P算力、日产10万亿Token。用DCU度量投入,Token度量产出,重构智能生产与交付体系,适配不同企业需求。

量子位
推荐文章7

为什么你的 AI Coding 账单越涨越快?十个节约 Token 的工程办法。

文章指出今年大模型Token账单涨得快,尤其AI编程重度用户。从工程角度总结降Token消耗的方法,如上下文清场、代码导航等,还分析AI Coding的Token变贵原因及各方法适用边界。

AI大模型应用实践
产品应用7

Fable 5.1变身Token刺客,几分钟烧光额度!AI圈掀起「榨汁革命」

Anthropic发布的Fable 5.1虽性能强但极耗Token,引发开发者不满。当前AI产业面临算力饥渴与Token通胀问题,企业落地AI痛点多。迅策科技的TokenCloud平台能助力企业高效转化Token,还介绍了其配套产品TokenOS。

新智元
算法论文8

压缩,就是你所需要的全部」!菲尔兹奖得主Michael Freedman新作揭开数学真相

菲尔兹奖得主Michael Freedman认为人类真正创造和关心的数学本质是「柔软且可塑」的。他在最新论文提出「压缩,就是你所需要的全部」,并在采访中探讨人类数学直觉与机器逻辑的鸿沟,认为理解压缩机制是人类与AI在数学领域协作的起点。

机器之心
算法论文8

跨层压缩隐藏状态同时加速TTFT和压缩KV cache!

论文 UNCOMP 被 EMNLP 2025 主会接收,提出高效推理框架,用截断矩阵熵解释 LLM 稀疏化,据此设计 UNCOMP 框架,通过压缩隐藏状态优化 KV Cache,实现计算与内存联合优化,实验效果显著。

机器之心
新闻资讯8

截击英伟达!OpenClaw狂吞Token,北大系芯片黑马剑指2000 Tokens/s

NVIDIA GTC 2026前夕,AI推理赛道竞争激烈。北大系寒序科技宣布融资,首颗样片测试跑通,单位面积带宽达100GB/s/mm²,下一代「MRAM+SRAM」架构目标2000 Tokens/s,挑战英伟达。

新智元
推荐文章7

Token是这个时代最伟大的发明

博主黄益贺认为AI称得上科技革命,因其带来信息形态与交互方式的根本性变革,而这都归功于TokenToken实现信息形态大统一,带来信息交互方式变革,让信息可被自由召唤、定制化显现。

newtype AI
开源动态8

一图胜千言被实现了!DeepSeek-OCR用图片压缩文本,10倍压缩

DeepSeek开源DeepSeek - OCR,用图片压缩文本达10倍压缩率且几乎不丢信息。它解决了以往视觉编码器的问题,架构清晰,数据丰富,性能测试亮眼,为解决大模型‘记性差’问题提供新思路。

AIGC开放社区
新闻资讯7

Salesforce 最新研究:LLM 智能体 CRM 测试成功率至 35%,保密意识还,企业敢用吗?

Salesforce AI 研究团队新基准测试显示,LLM 智能体在 CRM 测试中表现欠佳,单步任务成功率约 58%,多步任务降至 35%,且保密意识,与企业需求差距大。

InfoQ
推荐文章7

Token 成为商品,AI 基础设施会怎么变化?

在大模型时代,智能生产和交付未实现工业化,存在性能鸿沟。九章云极提出AI工厂战略,发布Alaya NeW Cloud 3.0,将从资源计量转向智能计量,打造训练和Token工厂,提升算力到有效Token的转化效率。

InfoQ