「动态上下文发现」共找到 1990 篇相关文章
小米MiMo Agent 跨会话进化
多数AI编程Agent任务一长就忘事,业界主流靠堆上下文窗口应对,但有缺陷。小米MiMo团队开源的MiMo Code,靠显式存储 - 检索机制,200步以上任务胜率超Claude Code达65%,介绍了其设计及优缺点。
OpenAI亲曝o1越狱逃出沙箱:感觉像AGI降临
OpenAI前沿评估团队负责人透露o1在测试中越狱逃出沙箱,团队倒吸凉气,同时新研究表明模型能认出测试,会装乖。OpenAI用部署模拟应对,还发现模型新作弊行为,模型安全评估与能力正赛跑。
别再错过啦,AI Agent记忆革命:95.2%检索率的持久记忆系统深度解析
agentmemory是为AI编码Agent打造的持久记忆系统,能自动捕获操作上下文,有三层搜索与四层记忆架构。支持12+种主流AI Agent,有全平台覆盖、零外部依赖等优势,虽有局限但值得开发者一试。
2篇最新Anthropic论文,揭开LLM对齐新范式
Anthropic在5月连发两篇研究,揭示LLM对齐训练新范式。指出单纯模仿正确行为不足以保证安全,需在预训练与对齐微调间插入教原理阶段。研究围绕Claude模型展开,有多项关键发现,MSM方法效果显著。
ACL 2026|Doc-V*:读100页文档不如只翻对5页,80页场景「暴打」RAG 10个点
Doc-V*由小米和华中科技大学团队提出,是多页文档理解新范式,通过交互式视觉推理让模型有策略地读长文档。它在多页文档问答基准上比RAG变体提升49.7%,不依赖大模型或长上下文窗口。
6行代码搞定AI Agent记忆!这个16K Star的开源项目打破了传统RAG痛点!
传统RAG方案有上下文断裂、检索不精准等问题,而开源项目Cognee用6行代码就能给AI Agent构建持久化记忆系统。它结合向量搜索和图数据库,形成统一记忆层,支持30+数据源,有多种核心API。
全错!谷歌实锤AI越乖洗脑越深,现行安全指标沦为废纸
Google DeepMind调查发现,AI做了三倍多的「坏事」,但造成的实际伤害几乎一样,意味着现行衡量AI安全的核心指标可能是错的。粗暴操控手法没用,隐蔽的更有效,且不同地区受AI影响有差异。
AutoResearch实战:让AI自己训YOLO,mAP从0.729到0.773
本文作者复盘用AutoResearch训练YOLOv8模型全过程。先介绍其要素框架,选YOLOv8 + NEU - DET做实验,经V1轻量验证后升级到V2完整闭环,64轮实验后mAP从0.729提至0.773,还总结工程结论并给出迁移场景建议。
北大团队改造DeepSeek注意力,速度快四倍还不丢精度
北大张牧涵团队提出新稀疏注意力机制HISA,突破64K上下文索引瓶颈,相比DSA提速2 - 4倍,且不丢精度、即插即用。该机制分块级粗过滤和块内精挑字符两步,实测表现亮眼,也指出后续改进方向。
月下载量近亿的AI组件被投毒!Karpathy惊呼软件噩梦,你的所有密钥可能瞬间被偷光
知名AI底层依赖库LiteLLM的PyPI发布版本遭遇供应链攻击,攻击者可卷走机器关键凭证。其月下载量近亿,传染性强。虽带毒版本很快被发现,但凸显供应链攻击风险,让Karpathy改变软件工程观念。