记忆评测基准」共找到 1793 篇相关文章

产品应用8

首个大规模记忆湖发布,AI Infra跑步进入“记忆”时代

LLM是AI的“第一大脑”,记忆平台是“第二大脑”。当前AI企业应用进入生产力时代,竞争聚焦“隐性知识”记忆化。质变科技发布MemoryLake,具备多方面能力,在性能上优势显著,已服务众多用户和企业。

量子位
开源动态7

直播预约 | LightMem:面向大模型的轻量化可插拔记忆系统

本报告聚焦大语言模型长期记忆构建与轻量化机制。现有外部记忆系统有记忆臃肿、组织低效、更新代价高问题。为此提出LightMem架构,能为大模型提供轻量、高效、可扩展记忆组件。

深度学习自然语言处理
开源动态7

LangChain Memory 太弱?试试用 MemOS 构建 Agent 专属的“记忆图谱”。

文章聚焦 MemOS 开源框架,深入体验其记忆“图谱”能力,探讨将它集成到基于 LangChain1.x 框架构建的智能体的方法。介绍了基于记忆“图谱”构建 ChatBot、体验记忆“图谱”自动重组,以及集成到 LangChain 智能体等内容。

AI大模型应用实践
推荐文章8

大模型微调评测入门:看懂这些指标,才知道模型好不好

文章指出大模型微调中很多新手重“调”轻“评”,评测是决定模型落地的关键。介绍分类和生成任务评测指标,给出实操步骤,还说明如何综合判断模型好坏,最后展望评测技术朝自动化等方向发展。

机器学习AI算法工程
算法论文8

硅基大脑记忆觉醒!会遗忘、会反思、会成长的AI正在到来

哈尔滨工业大学等机构团队发表研究,用认知神经科学视角审视AI记忆系统,探讨如何让AI产生“自我”,构建会遗忘、反思、成长的记忆大脑,还涉及记忆分类、存储、管理、评估、防御及未来演进等内容。

AIGC开放社区
算法论文8

NTU等联合提出A-MemGuard:为AI记忆上锁,投毒攻击成功率暴降95%

在AI智能体依赖记忆系统的当下,记忆投毒攻击兴起。A-MemGuard作为首个为LLM Agent记忆模块设计的防御框架,通过共识验证和双重记忆结构,解决防御难题,使投毒攻击成功率暴降超95%。

新智元
产品应用8

养虾省91%词元!这家AI记忆公司用1亿个多模态文件验证了!

文章指出AI瓶颈已从模型智能转为记忆架构,长期记忆是AI有状态智能的基础。质变科技推出多模态AI记忆平台MemoryLake,具多种记忆能力和核心技术,降本增效显著,获资本青睐,服务多领域客户。

机器之心
开源动态8

MemOS:一种用于 AI 应用的记忆操作系统

大型语言模型缺乏记忆管理系统,限制其发展。MemTensor与高校联合开源MemOS,它将记忆视为可管理资源,有三层架构,系统化三种记忆类型。评估显示其在推理、检索、加速等方面表现优异。

PaperAgent
算法论文8

清华唐杰团队揭示大模型记忆全景

清华唐杰教授团队等发布大模型记忆架构综述,提出三维记忆分类学,将前沿工作统一到理论框架,为LLM设计指明方向,分析了隐式、显式记忆架构,还探讨混合架构挑战与未来方向。

量子位
开源动态8

AI医生终于有了硬标尺!全球首个专病循证评测框架GAPS发布,蚂蚁联合北大王俊院士团队出品

蚂蚁健康与北大王俊院士团队发布全球首个大模型专病循证能力评测框架GAPS及评测集GAPS - NSCLC - preview,解决现有医疗AI评测局限,成果已应用于“蚂蚁阿福”,并客观评价了大模型临床能力。

量子位