token使用量」共找到 2397 篇相关文章

新闻资讯7

旋科技完成B轮融资,资本为何重注看似遥远的子计算?|甲子光年

近日,旋科技完成数亿元B系列轮融资。子计算市场前景大,虽面临挑战,但产业正从技术研发迈向产业化。旋科技选超导与核磁共振两条技术路线,其发展分三阶段,未来或与AI结合。

甲子光年
算法论文8

1.5B刷新数学代码SOTA!快手&清华精细化Token管理,LLM推理能力飙升

快手与清华团队用1.5B参数小模型在推理基准上超越同级SOTA。其Archer方法通过精细化Token管理,对知识型和推理型Token差异化训练,让知识和推理同步更新且互不干扰,在数学和代码任务表现出色。

量子位
算法论文8

仅保留35% Token,性能反超原模型!快手可灵等用视觉信息引导音频压缩,推理时间直降42%

Omni - LLM计算浪费严重,快手可灵等团队提出OmniSIFT框架。它利用音视频非对称依赖关系,通过时空联合剪枝压缩视频、视觉引导筛选音频Token,大幅减少Token,提升性能和推理效率。

量子位
新闻资讯7

Token 新译名:「智元」

文章讨论Token新译名「智元」,认为其比「词元」更合适。介绍英伟达GTC 2026上黄仁勋强调AI推理时代智元重要性,OpenClaw消耗大智元引争议,还提及黄仁勋闭门会观点及多位大佬对「智元」译名的认可。

新智元
新闻资讯7

Agent 的 Token 账单怎么省?

AI 行业从生成式能力向 Agent 行动力跃迁,核心矛盾转向推理成本可控性。随着企业将 Agent 编入自动化流水线,Token 消耗受关注,业界开始聚焦以「降本」为核心的技术路线。

机器之心
开源动态8

无痛使用vLLM的工具来了!

vLLM功能强大但上手门槛高,开源项目vLLM Playground是界面化工具,能解决使用难题。它零配置,集成官方vLLM recipes,内置性能测试,安装简单,对业务团队很友好。

AI工程化
推荐文章7

Token,应该翻译成「新智元」

作者经信息论分析、构词法验证等,提议将Token中文标准译名定为「新智元」。现有译名如「托肯」「令牌」等都不满足要求,「新智元」能覆盖技术和经济属性,符合翻译学标准。

新智元
算法论文7

The Batch: 881 | 一千万 token 的输入上下文

Google的Ali Behrouz等人设计“记忆模块”集成到类transformer架构ATLAS,能处理一千万token输入。它替代注意力层,训练后在长上下文任务中表现佳,但小模型,大规模表现未知。

DeeplearningAI
产品应用8

OpenAI 内部揭秘:我们如何使用 Codex

文章揭秘 OpenAI 内部使用 Codex 的情况,介绍其在理解代码、重构迁移、性能优化等多方面的应用场景,还给出最佳实践,如用‘提问模式’开始、组织好提示等,展现了 Codex 强大的开发辅助能力。

宝玉AI
产品应用7

Google官方发布nano banana使用指南

Google官方发布nano banana使用指南,介绍其核心能力,如角色一致性、精确局部编辑等,还给出写提示词的6要素、5种实用技巧,同时指出模型存在风格化不一致、文字渲染易出错等问题。

AI工程化