「token使用」共找到 1875 篇相关文章
破解大模型「无效并行推理」:Parallel-Probe问世,并行推理效率提升35.8%
来自多所高校的研究团队提出 Parallel-Probe,通过 2D Probing 刻画并行推理动态,发现问题后提出控制算法,能降推理延迟 35.8%、总 token 成本 25.8%,还推出 SCOUT 测试床,代码和平台已开源。
Skills:从编程工具的配角到Agent研发的核心
文章探讨了Skills在AI Agent发展中的价值演变与适用场景,指出其价值具高度场景依赖性。在Claude Code编程工具中它表现平淡,在Agent研发中价值凸显,还给出使用场景判断维度与发展方向。
刚刚Gemini上新模型,全球只有7人比它会编程,谷歌姚顺宇参与
北京时间周五凌晨,谷歌发布Gemini 3 Deep Think重大升级,在多学术基准测试中取得佳绩,成本大幅降低,编程能力超多数人。在多科学领域表现出色,还推动了实际应用,已上线供部分用户使用。
强化学习远不是最优,CMU刚刚提出最大似然强化学习
CMU等机构研究指出,现实中广泛使用的强化学习未真正做最大似然优化,只是优化其一阶近似。基于此,团队提出最大似然强化学习,实验显示其在性能与计算效率权衡上优于现有方法。
Claude Code 团队的 10 个内部技巧,但你不一定都要学
Claude Code团队分享10条内部技巧,像并行运行、Plan Mode等。介绍各技巧做法、价值及注意点,如并行运行虽提升效率但非适合所有人,投资CLAUDE.md性价比高,且强调找到适合自己的使用方式。
Mini-sglang-01:从Client到Scheduler的消息流转之旅
文章围绕轻量化大模型推理系统mini - sglang,详细介绍消息从客户端经APIServer、Tokenizer到Scheduler的流转过程,分析核心组件功能、消息体系、正反向链路及优化策略,还预告后续分析调度和模型实现逻辑。
OpenAI 发布新的 Codex 桌面版,我现在不骂 Codex 难用了
OpenAI发布Codex Desktop App,是macOS桌面应用。它有图形界面,支持定时任务、Skills管理和多Agent并行运行。还对比了与Claude Code的差别,介绍了OpenClaw项目,最后说明不同用户的使用场景和用量定价。
大模型的第一性原理:(二)信号处理篇
本文从信号处理角度解读大模型原论文,探讨语义向量化原理,分析 Transformer 与 Granger 因果关系。指出大模型输入 Token 语义嵌入是将自然语言处理转化为信号处理问题,向量化与信号处理、信息论联系紧密。
Anthropic最新经济指数:AI让高学历任务提速12倍,但也可能让你的工作“降级”
Anthropic通过‘经济指数’项目,对Claude.ai和其API对话分析。最新报告引入‘经济基元’,基于2025年11月样本分析,揭示AI对任务、职业和总体影响,如让高学历任务提速12倍,也可能致岗位‘技能降级’。
架构师困境:选择已被验证的道路,还是自行开辟一条新路?
开发软件时,团队要做产品功能和架构决策,面临选已验证路径还是自辟新路的困境。使用平台和框架虽能加快开发,但有副作用。团队需通过实验判断何时扩展或替换平台。