「上下文记忆」共找到 1100 篇相关文章
Agent不是关键!人大AiScientist实现23小时、74轮长程记忆
中国人民大学团队打造的AiScientist,旨在解决长程机器学习研究工程的持续性难题。它通过File - as - Bus机制稳定保存项目状态,在多轮实验中表现出色,提升科研效率,推动AI真正接手科研流程。
Gemini桌面客户端终于上线:直接读取屏幕上下文,帮你解读一切!
谷歌推出Gemini的macOS原生客户端,支持全局快捷键拉起和窗口共享。它能突破浏览器限制,基于屏幕内容提供反馈,但目前离真正的桌面助手还有差距,后续有望补齐能力。
Gemini盘活了谷歌全家桶,“原生”自带你10年的记忆
谷歌发布由Gemini3驱动的“Personal Intelligence”功能,底层连接旗下四大应用,让AI跨应用获取数据,还内置纠错机制。该功能现处Beta测试,未来覆盖免费用户。谷歌与苹果引入Gemini后路径不同,AI竞争也转向生态构建。
思维链可无限延伸了,MIT等打破大模型上下文天花板
MIT等机构提出新架构Thread Inference Model(TIM),配合专用推理引擎TIMRUN,把推理过程变为树状递归子任务结构并修剪子任务,让模型突破输出窗口限制实现长程推理,实验验证了其性能。
从《塞尔达传说》理解 Agent 的上下文工程:Claude Skills 还是被低估了
Claude Skills 是为 AI 设计的「技能包」,能把复杂任务指令打包。作者认为其信息分层设计哲学是关键突破,以《塞尔达传说》为例,介绍了信息分层和按需加载理念,还阐述了三层架构及应用案例、挑战和通用原则。
模型遗忘不代表记忆抹除!首次系统发现「可逆性遗忘」背后规律
研究人员发现大语言模型遗忘并非简单信息删除,可能藏于内部。他们构建表示空间诊断工具,区分可逆与不可逆遗忘,揭示真正遗忘是结构抹除。还在多种方法、数据集和模型上实证,得出系列结论。
小米万亿模型全面开源:MIT 协议、1M 上下文,但还是打不过 DeepSeek
小米开源 MiMo-V2.5 和 MiMo-V2.5-Pro 两款模型,采用 MIT 协议,适合商业应用。在基准测试中表现出色,有竞争力价格和限时优惠。但与 DeepSeek 比,架构创新偏工程化,也有推理表现不足等问题。
隐藏超多上下文工程(Context Engineering)技巧的框架,来试一试吧!
文章指出多数人构建的AI Agent像Shallow Agent,处理复杂任务能力弱。以Claude Code等为例,介绍深度Agent架构的秘密,如冗长提示词、规划工具等,还推出开源包deepagents方便上手。
Pinecone 推出 Nexus 引擎:为 AI 智能体整合业务上下文并生成结构化数据
Pinecone Nexus 全面上线,是面向 AI 智能体的“知识引擎”,能将企业数据转为结构化数据层,复用数据提准确性、降成本。早期采用者在金融、法律领域看到显著性能提升,词元消耗大幅降低。
经验记忆黑科技:LightSearcher让AI工具调用减39.6%、推理快48.6%
现有的 RL 驱动的深度思考大模型系统面临准确率与效率的「跷跷板」困境,北邮百家 AI 团队提出 LightSearcher 框架,解决了这一痛点,在保持准确率的同时,显著提升了工具调用效率。