长时记忆」共找到 1637 篇相关文章

算法论文8

不改模型也能提升推理性能?ICLR投稿提出测试扩展新范式OTV

ICLR 2026投稿论文提出单token验证(OTV),是测试扩展新机制,让模型能边推理边判断正误。它基于并行思考思路,借助轻量内部验证器分析推理过程,实验显示其性能优于主流方法。

量子位
算法论文8

2026,一篇不错的高效Agents技术全面综述

上海AI Lab等9所高校联合发表《迈向高效智能体(Agents):记忆、工具学习与规划综述》。文章介绍了高效智能体概念,分析其效率危机,阐述提升效率的三大战略方向,涵盖多种记忆、工具学习和规划方法。

PaperAgent
算法论文8

扩展外部测试Scaling Law,中关村学院新发现:轻量级验证器可解锁LLM推理最优选择

文章聚焦大语言模型‘测试扩展’,指出内部方法接近瓶颈,外部方法的传统实现有缺陷。提出 TrajSelector 策略,用轻量级打分模型复用隐状态打分,训练无需手动标注,实验显示性能增稳定。

机器之心
新闻资讯7

金山、Zilliz、腾讯、灵犀量子专家齐聚,揭秘 AI 记忆、RAG 演进与自我进化的工程实践 | AICon

2025 年构建复杂 AI 系统面临记忆缺失、检索瓶颈、认知固化等系统工程挑战,Context Engineering 是关键。AICon 北京站邀金山、Zilliz、腾讯、灵犀量子专家,分享上下文工程技术实践。

InfoQ
新闻资讯7

对话 OPPO AI 姜昱辰:手机才是 Memory 最好的土壤,AI 一定会彻底改变智能手机

文章是对OPPO AI姜昱辰的访谈。他认为AI会改变智能手机,OPPO将小布记忆做成跨系统收藏夹。产品迭代后记得更广、更深、更有用,团队还探索记忆分层、更新等,也重视用户隐私和主动推荐能力提升。

Founder Park
推荐文章7

【博客转载】CUDA Constant Memory

文章介绍 CUDA 常量内存,它是设备上 64KB 被缓存的只读特殊内存空间。通过示例比较不同访问模式下常量内存和全局内存性能,指出块或 warp 一次访问,常量内存快 10%;线程一次或伪随机访问,慢很多。

GiantPandaLLM
算法论文8

全新线性注意力范式!哈工深张正团队提出模感知线性注意力!显存直降92.3%!

哈工深张正团队联合多团队发布论文,提出 NaLaFormer 框架,解决线性注意力两大核心缺陷,保持线性复杂度同精度超越,在多任务表现出色,如超分任务显存降 92.3%。

机器之心
算法论文8

LLM算力告急?把文本变图片,推理成本直接减半!

大型语言模型处理文本计算成本高,本论文探索‘文本即图像’输入压缩策略,将文本渲染为图像输入多模态模型,可减少近一半令牌,且任务性能不受显著影响,在多任务中验证了其有效性。

深度学习自然语言处理
算法论文7

1/3预算跑平 GPT-5?上海AI Lab「路由魔法」成本直降63%性能反涨 7%!

当前大模型需解决性能与效率平衡问题,GPT - 5用测试路由技术初步平衡。Avengers - Pro测试路由框架集成不同LLMs,通过嵌入、聚类、评分操作,调整权衡参数α,能依查询特征选模型,性能和效率优于单一模型。

CourseAI
算法论文8

大模型推理上限再突破:「自适应难易度蒸馏」超越R1蒸馏,CoT语料质量飞升

本文从中兴通讯无线研究院「大模型深潜」团队切入,介绍了首创的「LLM自适应题目难度蒸馏」方法,该方法围绕「模型 - 数据动态匹配」提出了一条完整的CoT构建流程,显著提升了CoT语料的质量。

机器之心