「精细化Token管理」共找到 1205 篇相关文章
Claude Sonnet 4 API 支持百万上下文:解锁真正的生产级AI工程
Anthropic宣布Claude Sonnet 4支持100万Token上下文窗口,容量是之前5倍。长上下文支持已向部分客户公测,将推给更多用户。该功能已在亚马逊Bedrock公测,也将登陆Google Cloud。还介绍了用例、定价及早期用户好评。
Claude Fable 5重新上线!GPT-5.6秒跟
Claude Fable 5重新上线,或为小范围灰度测试。此前因出口管制停产近两周。它能力强但烧Token,社区一直盼回归。同时,GPT - 5.6在Fable 5上线后秒跟,将分批发布。
全国首部“AI生成内容合规”标准,现公开征集起草单位和个人
随着AIGC转向产业落地,监管对生成内容管控成趋势,AI生成内容风险也凸显。全国首个AI生成内容合规团体标准《人工智能生成内容合规管理指南》应运而生,现公开征集起草单位和个人。
2027年至少营收1万亿美元!龙虾就是新操作系统丨黄仁勋GTC万字实录
2026年3月16日英伟达GTC大会上,黄仁勋阐述英伟达从芯片公司向AI基础设施和工厂公司的蜕变,给出强劲业绩预期,介绍“Token工厂经济学”,还展示新系统、技术,提及AI软件和生态革命等。
Anthropic官宣PTC突破,中国开发者一年前就实现了
2025年11月24日,Anthropic发布PTC特性,让Claude通过代码编排工具执行。但国产minion框架早有类似架构,不仅将此作为基础架构,还支持Python生态、状态管理等功能,在实际应用中更高效灵活。
硅基公司裁员二三事
作者回顾2017年入职硅基智能(当时叫南京必拓狮)的经历,讲述公司转型AI赛道的过程、产品开发情况,以及老板司马华鹏的想法和管理方式,还总结了创业应注意的教训。
关键突破:理论验证了 RL for LLM 路线的可行性
传统RLHF依赖人工标注偏好数据训练奖励模型,成本高且难扩展。本文发现任何通过Next - token预测训练的LLM内部隐含通用奖励模型,从理论和实验证明其可高效实现模型对齐。
自建一个 Agent 很难吗?一语道破,万语难明
作者分享给传统研发平台接入 Agent 开发能力的经验,介绍技术选型、方案落地、系统提示词优化、知识库建设等内容,还提及工具接入、上下文管理等方面,为想自建 Agent 的人提供启发。
TACO: 让 CLI Agent 在自主迭代中学会丢掉无用上下文
由多校及研究团队联合提出 TACO,这是无需训练、即插即用的终端智能体自进化观测压缩框架。它能让智能体学习压缩规则,过滤低价值输出,保留关键线索,实验显示其提升了任务成功率和 token 效率。
中国AI创业者重登GTC舞台:杨植麟用技术语言讲了一个智能上限突破的浪漫故事|甲子光年
美国当地时间3月17日,月之暗面(Kimi)创始人杨植麟在英伟达GTC演讲,介绍Kimi技术路线图。他提出开源模型要出色,给出Token效率、长上下文、智能体集群三个概念,还探索了未来架构,且将创新开源。