「Token调用量」共找到 1514 篇相关文章
10% KV Cache实现无损数学推理!这个开源方法解决推理大模型「记忆过载」难题
推理大模型推理时易现冗余问题,R-KV开源方法登场,显存降90%、吞吐提6.6倍、准确率达100%。它通过实时对token排序解决冗余,还经多步骤压缩KV缓存,性能测试表现出色,适用多场景。
SIGGRAPH 2025最佳论文出炉,清华、上科大、厦大获奖!谷歌拿下两篇
SIGGRAPH 2025技术论文奖项揭晓,投稿量首破970篇。5篇最佳论文涉及3D重建、图像个性化等前沿方向,清华、厦大、上科大均有入选,还有荣誉提名论文和时间检验奖论文公布。
大模型微调知识与实践分享
文章详细介绍大型语言模型(LLM)微调知识与实践,包括模型结构、参数量等知识,以及Prompt工程、数据构造、LoRA微调等技术点。还给出微调实践流程,介绍相关平台和框架,如星云、TuningFactory等。
成熟工程师1天完成调试,AI工程实践被MCP彻底颠覆?
去年11月Anthropic发布模型上下文协议(MCP),开发者社区迅速采用,AWS、GitHub、OpenAI等也已采用。MCP标准化数据和工具与AI代理的集成,简化定制化AI应用构建。采访华院计算杨小东,解析其架构、应用及商业价值。
最全面人类细胞图谱发布:110万个细胞看清调控与衰老
本文是对最新发表的Tabula Sapiens 2.0人类细胞图谱的专业解读,该图谱相比1.0细胞量翻倍至110余万个,覆盖28种组织,解析了细胞调控机制与细胞衰老特征,且完全开放供研究使用。
百年黎曼猜想被Claude破了新纪录!是个未公开新模型
A社官宣未公开的Claude研究模型在黎曼猜想取得重大进展,将满足猜想的黎曼ζ函数零点比例下界从41.6%提高到67.2%。它靠60个智能体、3100万输出Token完成研究,几乎走完科研流程。
刚刚,Kimi K3开源!3万亿模型权重全球开放
2026年7月27日,Moonshot AI开源全球首个3万亿参数级模型Kimi K3。它不仅参数量大,还在多领域表现出色,能与顶尖闭源模型媲美。其架构创新、训练独特、推理成本低,有望改变全球大模型格局。
调高一档推理强度,成本可能翻几倍:大模型思考原理讲清楚
文章详细讲解推理强度原理,指出其不改模型,只改草稿长度。还说明模型多思考能提高答题准确率的原因,剖析贵和慢的原因,介绍三种控制形态,并给出判断推理强度档位的框架。
AI 产业终于等来了自己的“支付宝时刻”
本周支付宝发布面向 AI Agentic Commerce 的全栈支付解决方案。该方案含信任基座、收付引擎、AI 钱包助手和 Token Pay,解决支付安全、收付款及管控等问题,推动 AI 产业从工具走向商业循环。
“OpenClaw 类”自进化智能体代表项目介绍
文章指出传统 Agent 存在记忆短暂、能力固定的瓶颈,介绍了 OpenClaw 生态中“自进化”的不同形态,还列举了 Nanobot、AutoResearchClaw 等多个代表性项目,阐述其特点和应用场景,最后抽象出自进化智能体的共同要素和工程模式。