「记忆增强型大语言模型」共找到 1920 篇相关文章
《TAML》好文推荐 | 来自清华大学张宇飞团队最新研究成果 基于文本生成翼型:FoilCLIP,一种语言驱动的气动设计新框架
传统翼型设计依赖CFD和风洞试验,成本高。清华大学张宇飞团队提出端到端双向映射框架FoilCLIP,通过对比学习建立文本与翼型几何双向映射,还提出数据增强策略,验证了其在语言驱动设计中的应用潜力。
对话 MoonBit 张宏波:为 AI 重构编程语言
文章围绕 MoonBit 语言开发者张宏波展开,探讨为 AI 重构编程语言。指出当前 AI Coding 基于旧有语言有局限,MoonBit 有原生 AI 支持,还介绍其开发历程、特性及 Pilot 工具创新,强调未来商业化愿景。
「Memory as a Context」是否将重新定义 Transformer 的 「记忆模式」?
本期机器之心PRO会员通讯解读3个AI业内要事,包括「Memory as a Context」能否重新定义Transformer记忆模式、世界模型发展情况,以及OpenRouter联合a16z发布的《State of AI》报告。详细探讨了谷歌Titans架构及其理论框架MIRAS,还提及业界对LLM记忆力的改进方案。
深度拆解 Hermes Agent 的记忆系统:它如何修正 OpenClaw 的误区
文章深度拆解 Hermes Agent 记忆系统,介绍其四层记忆系统,包括提示词记忆、SQLite 历史会话存档、智能体技能管理和用户建模。与 OpenClaw 对比,Hermes 更关注缓存效率,遵循冷热分离、缓存优先等原则。
Meta 删邮件事故背后,OpenClaw 为什么会“失忆”?代码库维护者拆解记忆架构
OpenClaw在使用中易“失忆”,如Meta对齐总监用它处理邮件时失去控制。文章从代码库维护者视角,拆解记忆架构,介绍记忆层次、失败模式,给出配置建议和故障排除方法,助用户了解并优化其记忆机制。
Vector数据库退位,AI记忆Memvid登场!
近期基于视频的AI记忆库Memvid大火,宣称革新AI记忆管理,能将文本片段存于MP4实现快速语义搜索。不过网友分析,它底层用FAISS,读写慢、文件大,仓库issues也显示其性能与声称相反。
Agents统一综述:Harness、记忆、Skills和协议
上交大、中山大学等发表长文对LLM Agents中的记忆、Skills、协议与Harness工程进行统一综述。介绍了从权重到上下文再到Harness能力的三次迁移,阐述记忆、技能、协议系统及Harness工程,还分析了模块间耦合。
性能提升400%!AutoResearchClaw自主设计多模态记忆大脑
AI助手积累海量多模态数据,记忆和提取成瓶颈。北卡罗来纳大学等团队用AutoResearchClaw让AI 72小时完成多模态记忆系统设计,性能提升超400%,新系统OMNIMEM全面碾压现有主流系统。
利用Loop语言模型扩展隐式推理 | 直播预约
当前大语言模型依赖显式文本生成推理,未充分利用预训练数据。将介绍最新工作Ouro,Loop语言模型家族,核心创新多,虽参数少却性能优,还会讨论其推理轨迹及模型Scaling新可能。
直播预约 | 迈向用于演绎推理的诚实语言模型
本次讲座聚焦迈向用于演绎推理的诚实语言模型。当前语言模型难诚实推理,输入不足会产生无根据答案。为此制定多步骤任务,提出强化学习方法ACNCHOR,稳定学习过程、提高推理性能。