记忆模块」共找到 749 篇相关文章

算法论文8

Dense、MoE之外第三条Scaling路径:交大提出JTok模块,省1/3算力

上海交通大学与小红书Hi Lab联合团队提出JTok/JTok - M模块,作为插件挂载在Transformer层,几乎不增算力和显存开销却显著提升性能。该模块构建新scaling路径,在多任务测试中全面提分,为大模型发展提供新方向。

机器之心
开源动态8

96.6%召回率,0美元成本:这款开源AI记忆系统凭什么超越一切付费方案

AI记忆差困扰技术人,MemPalace开源AI记忆系统解决痛点。它可本地运行、0成本,召回率最高达100%,采用独特结构设计和AAAK语言,还能通过MCP提供工具能力,且团队诚实说明偏差。

小华同学ai
产品应用7

一个记忆库,N 个 AI 助手用!mem0 OpenMemory MCP 打通 Cursor/Claude/Windsurf ~

OpenMemory MCP是本地运行的共享记忆系统,基于MCP协议,让多个AI工具共享上下文记忆。它通吃主流MCP客户端,提供标准API,数据私密,有可视化面板且一键安装。官方列举应用场景,虽扩展性待考,但方向值得关注。

AI进修生
开源动态8

探针伸进大模型黑箱,南加州大学华人团队打造AI记忆研究的深空望远镜

南加州大学 Robin Jia 教授团队借助英伟达算力,构建基于 Llama 3 架构的全开源受控大模型 Hubble,其成果将在 ICLR 2026 亮相。研究揭示大模型记忆机制效应,还评估了‘机器遗忘’技术,有法律应用潜力。

DeepTech深科技
算法论文7

引入小目标注意力模块改进YOLO12用于无人机视角下的岸边人员玩水检测

文章介绍用小目标注意力模块改进YOLO12,用于无人机视角下岸边人员玩水检测。先介绍YOLO12特点与结构,再说明小目标注意力模块CBAM优势、流程及代码,接着阐述改进方法、数据集情况,最后给出训练和测试模型的代码与结果。

机器学习AI算法工程
开源动态8

告别大模型“失忆”!人大开源MemSifter:轻量代理先思考再回忆,搞定长时记忆

当前大语言模型在长周期任务中,长时持久记忆管理陷入“精度不够”和“成本太高”的两难困境。中国人民大学团队提出MemSifter框架,将记忆检索工作外包给轻量级代理模型,在8个权威测试中超越现有方案,且已开源。

PaperAgent
开源动态8

6行代码搞定AI Agent记忆!这个16K Star的开源项目打破了传统RAG痛点!

传统RAG方案有上下文断裂、检索不精准等问题,而开源项目Cognee用6行代码就能给AI Agent构建持久化记忆系统。它结合向量搜索和图数据库,形成统一记忆层,支持30+数据源,有多种核心API。

开源星探
推荐文章8

深入理解OpenClaw技术架构与实现原理(下)

文章为《深入理解OpenClaw技术架构与实现原理(下)》,讲解各系统模块,如SandBox沙箱系统、记忆管理等,还介绍自进化、工作区与路由等机制,最后展望企业级智能体架构和应用方向演进。

阿里云开发者
开源动态8

刚刚,DeepSeek 突发梁文锋署名新论文:V4 新架构提前曝光?

今天凌晨,DeepSeek在GitHub开源新论文与模块Engram,论文提出“查—算分离”机制,通过可扩展查找记忆结构提升模型表现。Engram将记忆与计算职责分离,或成V4核心技术,获网友肯定。

InfoQ
算法论文7

The Batch:826 | 提高输出准确性的记忆

通常提高大语言模型事实准确性需更大模型规模,会增加计算成本。Meta研究人员在transformer架构加可训练记忆层,可高效存储提取信息,提升计算效率,测试显示其能提升模型输出质量。

DeeplearningAI