「token使用量」共找到 2398 篇相关文章
Codex在推理框架上能蹬出什么优化
作者复盘用Codex在SGLang中的实践,原本需3 - 4个月的工作量现缩短为1个半月。介绍保证代码质量方法,分享印象深刻的debug经历,列举在SGLang用Codex一个月的优化成果,还提及Claude Code使用遇阻。
Claude能直接操控你的电脑微信了,这才是真正的上位小龙虾。
Claude新发更新,可通过Computer use纯视觉方案操控电脑,还更新了远程操控Dispatch。这俩功能组合让Claude能操控微信等本地软件,使用简单,且权限管控和防护较好,更新速度快,领先同类产品。
ICLR 2026出分,审稿员怒喷「精神病」!DeepMind研究员教你绝地求生
ICLR 2026评审结果公布,投稿量近2万篇创新高,但分数滑坡,平均分从5.12跌至4.2。审稿人吐槽质量低,甚至有怒喷‘精神病’的情况。DeepMind研究员提供论文反驳指南,称同行评审像‘随机数生成器’。
DeepSeek开源的不仅仅是个新OCR模型。。。
DeepSeek开源3B参数的新OCR模型,重新思考AI处理长文本方式,用视觉token压缩文本信息。核心组件有DeepEncoder和DeepSeek3B - MoE解码器,实验效果好,成本降低,还解决了一些算法和工程问题。
智能PPT生成系统
MultiAgentPPT是基于A2A + MCP + ADK的多智能体系统,能流式并发生成高质量PPT。它通过多智能体协作,从大纲生成到内容汇总,提高效率与准确性,还介绍了使用界面、项目结构、快速开始步骤等。
Fable 5被网友薅出省钱神招!最高减70%!
网友发现把Fable 5上下文转成图片,让模型通过OCR读取,token输入成本最多省70%。方法pxpipe在GitHub获3000+STAR,本质是本地代理,还引出谷歌老论文及DeepSeek - OCR相关技术。
黄仁勋率先开源量子AI大模型
英伟达推出全球首个开源量子AI模型家族NVIDIA Ising,含校准和纠错模型。它简化对复杂物理系统的理解,为量子纠错和校准提供高性能工具,有望加速量子系统实用化。
Anthropic自研AI面试官,深度访谈1250名职场人,揭示AI在工作中的真实影响
Anthropic发布Anthropic Interviewer工具,对1250名专业人士访谈。结果显示,人们对AI在工作中的作用普遍乐观但局部悲观,不同职业群体对AI态度和使用情况有差异,研究数据将公开。
冗长响应缩减80%,DeepSeek GRPO获得颠覆性改进,微软GFPO问世
微软研究员曝出颠覆性强化学习算法 GFPO,能削减推理多余 token 长度达 80%。它基于 DeepSeek 的 GRPO,可同时优化多响应属性,团队还提出自适应难度变体,实验显示 GFPO 在多方面表现出色。
Windsurf惊魂96小时!AI闪电并购战:谷歌天价挖人,Cognition逆袭接盘
7月,谷歌以翻倍薪资和24亿美金许可协议挖走Windsurf 40多位顶尖人才。周一,Cognition宣布收购其剩余资产和200来号员工。此前OpenAI收购谈崩,Windsurf还遇模型使用问题。