「上下文分割」共找到 695 篇相关文章
按token 计费,真的合理吗?
马克斯·普朗克软件系统研究所论文揭露,同样文本可被切分成不同数量token,用户难以验证是否被多收费。研究团队开发算法展示服务商多收费手段,还指出按字符计费可解决问题,但需行业达成共识。
蚂蚁集团发布KAG-Thinker,多跳问答慢思考,医疗领域拿下87分
在LLM问答领域,多跳问题存在局限性。蚂蚁集团发布KAG - Thinker,它是基于KAG框架的模型,能解决复杂问题的逻辑连贯性和上下文一致性。还介绍了其工作原理、示例、医疗应用及稳定性表现。
产品经理必读:AI智能体架构指南——为什么能力强不等于用户爱用?
文章为产品经理打造AI智能体架构指南,以客服智能体为例,阐述四个架构层面决策,分析主流架构方法优劣,还指出构建智能体要注重信任策略,第二部分将探讨自主性决策和治理问题。
GPT-5系统提示词突遭泄露,17803 token曝光OpenAI小心思!
一份全新GPT - 5系统提示词在GitHub泄露,有17803 token。此提示词设计精细,覆盖用户对齐、拟人风格、输出质量等。还展示了通用关键要求、安全对齐等方面内容。
从BERT到T5再到Qwen3:关于Embedding的八点总结
哈工大30+页综述聚焦通用文本嵌入(GPTE),系统介绍其架构、数据、模型,探讨预训练语言模型(PLM)给GPTE带来的基础能力与高级扩展,还涉及多模态、多语言、代码嵌入等应用。
微软推出深度视频探索智能体,登顶多个长视频理解基准
尽管LLMs和VLMs在视频分析和长语境处理有进展,但处理数小时长视频有局限。微软提出智能体Deep Video Discovery (DVD),以简洁框架在LVBench取得高准确率,将以MCP Server形式开源。
一文彻底搞懂 MCP:AI 大模型的标准化工具箱
MCP(模型上下文协议)是 Anthropic 于 2024 年 11 月开源的新技术,是 AI 大模型的标准化工具箱。它能让大模型与外界互动、获取信息、完成任务,整合 Function Call 标准,几乎所有大模型都可接入。
Claude Opus 4.7发布!这是你在别的公众号看不到的五个发现
Anthropic发布Claude Opus 4.7,编码和视觉能力提升,但长上下文能力下降。其231页的System Card藏着不少有趣发现,如Opus 4.7非最强模型、Claude知道被测试、模型审查自身评估等。
大佬深度解析:Coding Agent的底层运行逻辑是什么?
本文由AI领域知名学者Sebastian Raschka撰写,探讨编码智能体及其编排的设计、工作原理和组件协同。指出智能体周边支撑系统重要性不亚于模型本身,详细阐述编码智能体六大核心构建模块。
iPhone本地跑Gemma 4火了,0 token时代还有多远?
谷歌开源新模型Gemma 4,部分小型号可在手机端本地运行,速度惊人,还有128k上下文窗口。但在处理复杂任务时表现欠佳。未来端侧模型有望蚕食云端高频简单任务,将冲击现有AI商业模式。