「深度记忆」共找到 1237 篇相关文章
国产模型编程能力卷到这个程度了?MiniMax-M2.5 深度实测
文章深度实测MiniMax-M2.5编程能力,用其开发多款游戏和点名工具,结果出色。还分析其底层技术,如原生Agent RL框架、过程奖励机制等,指出它性价比高,虽有不足但值得关注。
华为Doc-Researcher 布局感知+视觉语义双杀
现有深度研究系统依赖文本网页数据,忽视多模态文档知识。华为Doc - Researcher系统解决多模态文档解析不足、检索策略有限、缺乏深度研究能力等问题,含多模块,能处理复杂多模态任务。
Karpathy刚进Anthropic,转头又投了它
AI初创公司Engram成立8个月,估值达6亿美金,获9800万美元融资。它聚焦AI记忆,用Cartridges技术降内存、提速度,将推理和记忆层拆开,团队成员背景强大,押注AI范式新转向。
李飞飞团队新作:DiT不训练直接改架构,模型深度减半,质量还提高了
本文介绍「嫁接」技术,可在小计算预算下编辑预训练 DiTs 探索新架构。不从头训练,替换算子创建混合架构,保持质量同时减少计算量。还通过实验展示该技术在构建高效架构和文生图模型中的效果。
Transformer已死?DeepMind正在押注另一条AGI路线
谷歌团队借鉴人类联想记忆,提出嵌套学习,解决AI「灾难性遗忘」问题。强调优化器与架构协同进化,构建联想记忆系统。HOPE架构在多任务表现出色,或开启AI从被动训练到主动进化大门。
AI 也有长久记忆了!谷歌Nested Learning让AI拥有持续学习的生命力
Google Research科学家研究直指AI领域难题,其论文《Nested Learning: The Illusion of Deep Learning Architectures》已提交NeurIPS 2025。Nested Learning打破认知框架,提出三大核心贡献,构建HOPE架构,性能优越,将改变终身学习应用领域。
AI越用越聪明,自主+自进化是关键拼图丨盛大邓亚峰EverMind@AIGC2026
在AIGC2026峰会上,盛大集团邓亚峰指出,AI范式从Chat转向Agent,未来AI需“自主”与“自进化”,长期记忆是关键。EverMind团队基于此研发相关技术,成果显著,还提出个人记忆主权等观点。
今年看到最系统的AI Agents时代Memory综述~
分享由NUS、人大等联合出品的《Memory in the Age of AI Agents: A Survey》。用三维框架讲透200+篇论文,提出新三大记忆形态,展望7大前沿,还涵盖记忆各方面知识及资源。
深度解析LLM Wiki / Obsidian-Wiki / GBrain:Agent时代知识的“自组织”与“自进化”
文章深度解析LLM Wiki、Obsidian - Wiki和GBrain项目,探讨Agent时代知识的“自组织”与“自进化”。指出传统知识管理有短板,而这些项目通过不同方式解决知识结构化、沉淀和更新问题,各有优劣。
Ilya尘封10年录音曝光!大二入Hinton门下,竟坦言机器学习反直觉
新智元报道,博主曝光Ilya 2015年谈论深度学习的语音片段。数学出身的Ilya认为机器学习违反直觉,大二与Hinton合作。他指出监督学习是最成功领域,还谈及神经网络目标函数、深度学习追求等观点。