「Token设计」共找到 1909 篇相关文章
重磅!全都看过来,Anthropic官方发布万字Skill创建完全指南:保姆级终极攻略
Anthropic官方发布万字Claude技能创建指南,涵盖规划、设计、测试和分发等知识,介绍技能结构、设计原则,提供不同用例模式及故障排查方法,适用于开发者、高级用户和团队。
NeurIPS 2025 Spotlight | 选择性知识蒸馏精准过滤:推测解码加速器AdaSPEC来了
大型语言模型推理延迟高、开销大,推测解码可加速但依赖草稿与主模型一致性。佐治亚理工等团队提出 AdaSPEC 蒸馏法,过滤难学 token,提升草稿模型与目标模型对齐度,实验显示能提升接受率和推理速度。
4400 人收藏的开源排版项目!Kami:让 AI 生成的文档,终于有了值得一看的排版!
开源作者tw93因不满AI生成文档排版,开发了Kami。它是给AI写的文档设计系统,有一套跨文档的约束集合,支持六种文档类型,安装简单,能让AI生成的文档排版更专业。
Figma 如何使用 AI 来支持而不是取代设计师
Figma 在设计平台集成 AI,有自动命名层等功能,能将文本提示等转换为生产就绪代码。其 AI 功能基于早期基础设施,关键在于 Dev Mode 和 MCP 服务器,确保设计师掌控输出,降低制作软件障碍。
GPT-5.4发布,拥有原生计算机操作能力,像是给OpenClaw量身打造的模型。
OpenAI凌晨发布GPT-5.4,或是4o模型后提升最大的一次。它价格较合理,有原生计算机操作能力,支持100万token上下文,还有工具搜索功能可降47% token损耗,与OpenClaw适配性佳。
ACL 2026 Main|混合推理模型也会「钻空子」:南大移动团队提出TNT,破解「假装不思考」骗奖励
大型推理模型存在「过度思考」问题,训练混合推理模型易出现奖励欺骗。南大等团队提出 TNT 方法,利用思考模式解答部分为问题动态设非思考模式 token 上限,解决奖励欺骗,实现准确率与效率双赢。
微软深夜发布SambaY架构,Phi-4min加速10倍推理
微软基于Phi - 4 - mini微调出Phi - 4 - mini - Flash - Reasoning 3B模型,扩展到200064 tokens。采用新型SambaY架构,支持64K token上下文长度,运行速度比前代快10倍,有诸多优点。
千万养虾人的终极梦想!全球首个「养虾本」带你懒人养虾开箱即食
荣耀发布自研 YOYOClaw 龙虾技术,首发于 MagicBook 系列,开创「养虾本」品类。该技术预置龙虾能力,具备自主学习,节省 50% Token,有设备级防护,实现多端共享,推动 AI 产业范式转变。
mcpx?要来拯救mcp!让工具调用不再吃掉你的上下文
MCP传统集成方式需在对话前加载所有工具定义,易使上下文溢出。开发者cs50victor基于mcp - cli构建mcpx,按需发现工具,大幅节省token,提升准确率,适合本地部署,虽有额外推理调用,但利大于弊。
刚刚!OpenAI训练GPT-4b攻克诺奖级“细胞再生”难题:效率狂飙50倍,连DNA损伤都能修复
OpenAI联手Retro Biosciences研发GPT - 4b micro用于蛋白质工程,让诺奖级细胞再生技术效率提升50倍,设计的新蛋白质还有DNA损伤修复功能,结果在多方面获验证。