向量压缩」共找到 293 篇相关文章

产品应用7

使用 Claude Code:会话管理与 100 万 上下文

本文是 Claude Code 的产品使用指南,介绍了其新更新的 /usage 命令,阐述了上下文、压缩、衰减等概念,还给出会话管理建议,如何时开新会话、用回溯替代纠正等,助用户用好该工具。

宝玉AI
新闻资讯8

OpenAI深夜双王炸!GPT-5.1 Pro紧急发布,降维打击Gemini 3

OpenAI同一天发布GPT-5.1 Pro和GPT-5.1-Codex-Max。前者向Pro订阅用户推出,主打「情商智商」双强;后者在Codex平台上线,专为「长时间、高强度」开发任务设计,采用「压缩」机制,表现出色。

新智元
算法论文7

DeepSeek-OCR是「长文本理解」未来方向?中科院新基准VTCBench给出答案

DeepSeek - OCR的VTC技术可实现高压缩率,降低长文本处理成本。但视觉语言模型能否理解压缩信息存疑,中科院等推出VTCBench评估,测试模型认知极限,还推出VTCBench - Wild检测鲁棒性。

机器之心
推荐文章8

Claude Code 开发者分享:如何管理百万上下文

Claude Code开发者Thariq分享管理百万上下文的心得。介绍了context概念、腐烂问题及压缩机制,提出完成操作后的五条岔路,还给出不同场景的决策建议,强调会话管理要平衡信息量和注意力。

AGI Hunt
开源动态7

我去,终于找到原因啦,58.4k Star MemPalace,不敢相信!!!!

AI编程中,上下文压缩后易丢失关键信息。MemPalace将对话和资料按原文存本地,按项目和主题精准找回。本文讲清其存储与检索原理、使用场景、注意事项及安装建议。

小华同学ai
推荐文章8

CC&LG实践|基于 LangGraph 一步步实现 Claude-Code 核心设计

本文深入剖析Claude - Code核心设计与关键技术,结合LangGraph框架,从基础ReAct Agent构建简版Claude - Code,涵盖人工审查、SubAgent实现、任务管理、上下文压缩等多方面,还提及流式响应升级及相关对比。

阿里云开发者
推荐文章7

详细介绍!RAG 和 GraphRAG:了解何时(When)、如何(How)使用它们

文章详细介绍传统RAG和GraphRAG技术,前者通过向量搜索检索上下文,但无法体现数据关系;后者用知识图谱提升检索效果,亮点是构建图谱、整合信息。还指出两者优缺点,建议结合使用。

AINLPer
新闻资讯7

Swiggy 内部 AI 助手升级:Text-to-SQL 不够用了,Agent 开始接管数据分析

Swiggy 推出基于生成式 AI 的 Text-to-SQL 助手 Hermes V3,运行在 Slack 中。它解决了旧版本问题,通过向量提示检索等升级,将 SQL 生成准确率从 54% 提至 93%,还增加会话记忆、解释层,与现有体系深度整合。

InfoQ
产品应用8

自媒体误读了 DeepSeek-OCR:一图胜千言

近期,DeepSeek-OCR引发关注,但很多媒体误读其为OCR工具,实际是视觉语言模型。它是为大文档等场景优化的视觉压缩与识别系统,架构新颖,训练讲究,效果出色,为行业带来新思路。

MacTalk
开源动态8

DeepSeek开源的不仅仅是个新OCR模型。。。

DeepSeek开源3B参数的新OCR模型,重新思考AI处理长文本方式,用视觉token压缩文本信息。核心组件有DeepEncoder和DeepSeek3B - MoE解码器,实验效果好,成本降低,还解决了一些算法和工程问题。

AI工程化