Token 效率」共找到 1758 篇相关文章

开源动态7

DeepSeek-OCR降本增效,10×暴力压缩还能读得清

Deepseek - OCR模型发布,通过光学压缩技术解决长文本处理的计算效率问题,能控制大模型token消耗成本。介绍了其架构设计、数据引擎及训练流程,还展示其用较少token超越现有模型的能力。

CourseAI
开源动态8

Thinking Machines 发布又一神作「在线策略蒸馏」 ,LLM后训练效率飙升50-100倍

Mira的THINKING MACHINES开源「在线策略蒸馏」LLM后训练方法,结合两种主流后训练范式优点,提升训练效率50 - 100倍,成本降低9到30倍,可用于数学推理、模型个性化等场景。

AI寒武纪
算法论文7

1万tokens是检验长文本的新基准,超过后18款大模型集体失智

Chroma团队研究发现,将上下文扩展至1万tokens,18款主流大模型集体“失智”,“智商”非均匀下降,在一些节点会断崖式下跌。研究还设计四项对照实验,证明LLMs性能随输入长度增加显著且非均匀下降。

量子位
开源动态8

Github 9.8K Star真香!!再见黑白屏,这款终端神器让十六进制分析一目了然,效率200%+!

传统十六进制查看器单色显示影响效率,hexyl 基于 Rust 开发,彩色输出区分字节,支持多系统,免费开源获 9.8K Star。它功能多,安装方便,是十六进制分析利器。

开源先锋
开源动态8

告别Selenium!这个8K+星的AI浏览器自动化神器,让爬虫开发效率飙升10倍

传统浏览器自动化工具基于‘精确选择器’,网站改版代码易崩溃。而Stagehand是新一代AI浏览器自动化框架,用自然语言控制浏览器,开发效率提升10倍,维护成本降80%,还具备自然语言操控、自我修复等功能。

小华同学ai
推荐文章8

百亿美金独角兽的 AI 革命:效率提升 10 倍,COO 和 CTO 联手,彻底改造工作流

本文介绍金融科技独角兽 Brex 的 AI 革命。其 AI 战略分四部分,CTO 和 COO 联手推进。公司把内部 AI 平台当产品,重构工作流,招聘转向通才,还给出工作流优先级标准,预计运营效率提 5 - 10 倍。

Founder Park
新闻资讯7

“如果你不用更多Token,就永远逃不出底层”:AI竞赛开始变成资源战争

文章围绕AI竞赛中资源分配问题展开,以SemiAnalysis创始人Dylan Patel经历为例,揭示Token成本疯涨、需求远超供给,介绍Anthropic模型优势,探讨具身智能成新需求点,分析竞争格局及供应链瓶颈,还预警反AI抗议。

InfoQ
新闻资讯8

开发者冲爆了!全球前十AI Lab无限免费,一周烧出3.12万亿Token

6月1日,全球模型榜单前十的Agnes AI无限期免费开放旗下核心全模态模型API,引发开发者热情。两周后周调用量达3.12万亿Token,本周还将升级,周五补齐语音全模态链路,开源社区也围绕其开展诸多项目。

新智元
产品应用8

Claude Code 省 Token 指南:慎用 1M 上下文,不开新会话或者总是开新会话都不对

文章聚焦Claude Code省Token问题,分析配额消耗快的原因,介绍提示缓存机制,给出省钱策略、操作规则,还提及委派工作及澄清误解,强调让缓存多命中、上下文少装无关内容。

宝玉AI
算法论文7

上交大和辉羲把LLM刻进ROM!推理性能冲2万token/s,GPU时代终结?

硅谷Taalas将大模型‘物理焊死’进芯片引关注,而上海交大、辉羲智能与微软亚洲研究院团队用ROM+SRAM异构架构,将端侧LLM推理速度推至20,000 tokens/s。介绍了ROMA和TOM架构优势及应用场景。

新智元