「Token成本」共找到 1994 篇相关文章
刚刚,OpenAI新Transformer火了!Astra架构首次曝光
OpenAI下一代Astra采用「循环深度」推理方法,思考Token减少但性能提升,不过其思考过程难监控。此前业界已对「循环Transformer」有研究,该架构适合数学编程任务,Astra实力获验证,GPT - 6或即将发布。
Fable 5.1 官方提示词指南
Anthropic 发布 Fable 5.1 后,同步发布《Prompting Claude Fable 5.1》提示词指南,列出 15 个 5.1 跟 Fable 5 在行为上的差异,并附修正提示词。还介绍了 Fable 5 提示词变化,以及 Fable 5.1 的新特性和应对建议。
别指望你的组织能变得 AI Native
一家公司买企业级 AI 授权全员铺开,虽 88% 员工采用,但交付速度未变,仅 10% 的人烧掉 90% 的 Token。文章指出企业 AI 采用率指标荒诞,分析企业 AI 应用现状,还给出落地推进建议。
PDL 在 SGLang Kimi K3 中的应用
文章介绍 PDL 在 SGLang Kimi K3 中的应用,K3 内核优化接入 PDL 以缩短相邻内核间隙。分析 PDL 原理、在 bs=1 decode 中解决的问题,阐述计算链和通信链上的应用,还提及性能数据和实现问题。
Pinecone 推出 Nexus 引擎:为 AI 智能体整合业务上下文并生成结构化数据
Pinecone Nexus 全面上线,是面向 AI 智能体的“知识引擎”,能将企业数据转为结构化数据层,复用数据提准确性、降成本。早期采用者在金融、法律领域看到显著性能提升,词元消耗大幅降低。
CVPR 2026 | 1000万段驾驶视频,教会模型如何估计相机位姿
Wayve的LA - Pose研究,不依赖百万级3D标注,从约1000万段未标注驾驶视频自监督学习‘潜在动作’,再用少量3D标注微调,转化为相机位姿估计能力,在多基准上提升精度且泛化能力强。
ICML 2026 | 华为GTS提出AI训练数据新方法,Amazon/Google作者团队「光速跟进」:难度自适应训练正在成为新范式
华为GTS研发部AI数据团队提出EDCO方法,将样本难度估计与动态课程编排引入领域大模型微调。该方法用推理熵动态编排训练课程,让模型面对最有学习价值的样本,已被ICML 2026接收。
实测LibTV团队版:AI视频的工作室时代来了!
作者实测LibTV团队版,分享用其制作皮克斯风格3D动画片段的过程,介绍团队版核心功能,如团队主体库、共享积分池、权限管理等,还提及新功能,指出AI视频走向工业化,而该团队版是首个专注团队协作的工具。
AMS | 西工大董戴玮、张伟伟等:求解偏微分方程的残差级联极限学习机
本文设计残差级联极限学习机(RC - ELM)缓解极限学习机(ELM)求解偏微分方程的病态问题。将多个ELM块级联,配备相同隐藏层,传递残差求解。实验显示,相比经典ELM,RC - ELM精度优势显著,误差降约4个数量级。
重估GEO:一场关于“谁能被AI相信”的战争打响了|甲子光年
2026年央视“3·15”晚会曝光AI大模型“AI投毒”黑灰产,却让GEO服务进入更多企业视野。360智见推出GEO产品,重构其为企业面向AI时代的基础设施,解决企业营销难题。