「token权重」共找到 806 篇相关文章
逼AI当山顶洞人!Claude防话痨插件爆火,网友:受够了AI废话
一个叫「caveman」的Claude Code插件在Hacker News爆火,冲破2w星。它核心是条prompt,删掉冠词等废话,号称省75%输出token。但它不压缩模型后台推理token,真实成本节省存疑。
openJiuwen协同昇腾打造智能体「算力亲和」技术,首token时延砍半,推理存储占用下降25%
传统推理引擎难以理解 Agent 任务状态,导致推理时延久、显存占用高等问题。openJiuwen 协同昇腾打造智能体「算力亲和」技术,建立语义协同机制,优化 KV Cache 管理,提升 Agent 系统运行效率。
一百万亿Token里的AI现状:OpenRouter和a16z重磅研究带你透视AI江湖
OpenRouter和a16z发布重磅研究,用100万亿Token绘制AI实景地图。2025年推理模型崛起,开源模型流量份额攀升,编程与角色扮演需求大,还揭示了用户留存的“灰姑娘效应”等,展现多元AI世界。
Lilian Weng:Harness才是模型自我迭代的现实起点和关键,而不是直接重写权重
Thinking Machines Lab联合创始人Lilian Weng发文指出,实现AI递归式自我改进(RSI),设计围绕模型的执行系统“Harness”才是现实起点。文中详述Harness设计模式、优化路径,也指出自我改进面临的瓶颈。
OpenAI突然开源新模型!99.9%的权重是0,新稀疏性方法代替MoE
OpenAI悄悄开源新模型,0.4B参数且99.9%权重为零,是Circuit Sparsity技术的开源实现。该技术通过约束模型内部连接稀疏性,解决传统稠密Transformer黑箱问题,或让MoE模型走上末路,但目前算力成本极高。
0人工参与实现梯度更新!MIT新框架让AI自动生成微调数据,权重自主升级
MIT提出新强化学习框架SEAL,可让模型生成微调数据和自我更新指令,实现权重更新。无需人工,模型能自动梯度更新。经知识注入和小样本学习实验验证效果,还介绍了其双循环工作机制。
AI 提效了,老板觉得自己又行了:可代码行数和 Token 排名,真该拿来裁人吗?
文章探讨AI提效下的行业现状。开发者节奏加快,企业收紧人力。不同行业提效有别,互联网显著,金融审慎。还谈及效率悖论、裁员依据、生产力衡量及成本管控,指出提效应用于承接项目而非裁员。
想知道你的LLM API被过度收费了吗?隐藏的Tokens终于可以被审计了
马里兰大学CASE Lab团队研究商业不透明大模型服务(COLS),定义其风险,提出三层审计蓝图。还推出验证框架CoIn,能高效识别token数量膨胀,有可定制性且审计开销低,为构建信任提供技术支撑。
智能体请求暴增 9.4 倍,token 账单却没涨:Uber 公开 AI 软件工厂省钱方法
AI 工具已嵌入 Uber 软件开发各阶段,智能体请求量增长 9.4 倍,但 AI 总支出自 4 月相对稳定。文章介绍其软件工厂思考,包括智能体会话层级、成本公式、指标测算及优化手段,还提及未来举措。
估值神话即将崩盘?Palantir CEO狂喷OpenAI和Anthtropic:拿走企业核心机密还要收过路费
Palantir CEO Alex Karp在电视采访中拆解OpenAI和Anthropic商业模式,指出企业花买token的钱未获匹配价值,商业机密被拿走。他质疑按token收费机制,认为不能稳定创造价值。还指出企业数据可能使模型取代自己,行业高估值或松动。