「记忆时间」共找到 900 篇相关文章
最新发现!每参数3.6比特,语言模型最多能记住这么多
Meta、DeepMind等团队研究语言模型记忆容量,提出新方法估计模型对数据点的‘了解’程度,发现GPT系列模型约每个参数3.6比特,还提出模型容量等相关定律,激发社区多方面思考。
中国首次提出半导体演进新原则:华为“韬定律”5 年内冲刺等效1.4nm制程,麒麟、昇腾将先后落地量产
5月25日,华为何庭波在研讨会上提出“韬定律”,以“时间缩微”替代“几何缩微”。论文展示验证案例,预计2031年高端芯片达1.4nm等效水平,今年秋季麒麟新芯片将首发“逻辑折叠”技术。
我给 Claude Code 加装了 MiniMax M2.5:它像“法拉利”,但更像一台工作机
作者给 Claude Code 加装 MiniMax M2.5 模型,测试其编程、上下文记忆等能力。M2.5 在多方面表现出色,能高效完成各类开发任务,还具备良好的中文处理能力,性价比高。
硬核拆解 OpenClaw:如何构建真正稳健的生产级 Agent 系统?【下】
本文延续上篇,继续拆解 OpenClaw 中 Agent 模块工程方法,涵盖安全与风险防御、记忆与状态管理、成本与效能优化、子 Agent 协作机制,介绍其方法并解读,指出企业场景需做取舍。
DeepSeek-V4蓄势待发!梁文锋署名论文或开启第二个DeepSeek时刻
据报道,DeepSeek将于2月发布新一代旗舰模型DeepSeek V4,其编程能力或超Claude和GPT系列。最新论文提出Engram条件记忆机制,分离死记硬背与逻辑推理,揭示新稀疏性分配定律。
想做成好的AI应用,先从把它砍成“一小时版本”开始「吴恩达老师开发心法」
吴恩达老师分享AI开发实用建议,若开发时间有限,应缩减项目范围,直至能在现有时间内完成。如他将“观众模拟器”项目精简,在短时间构建基础版本,获多方面收获。
复制这套神仙配置,让Claude Code全自动修Bug!告别每天重复教AI写代码
Claude写代码常犯重复错误,根源是无跨会话记忆。Claude code创始人Boris Cherny爆料团队让Claude自纠错,并分享配置让其自动发现、修复错误且不再重犯,介绍各步骤及完整配置和前后对比。
从browser-use 出发,品 Agent 实现
本文作者以学习总结视角,从browser - use出发解析Agent实现。介绍LLM不同阶段,阐述Agent记忆、规划、工具等要素,通过对话演示和源码分析展示运行机制,还探讨MCP集成和Coze space应用模式。
怎么做 Long-running Agents,Cursor、Anthropic 给了两种截然不同的思路
业界对让 Agent 长时间运行、执行复杂任务无共识。最近 Cursor 和 Anthropic 分享实践,思路不同。Cursor 用多 Agent 并行执行长时任务,Anthropic 解决单个 Agent 跨工作周期的记忆连续性问题。
ICML 2026 现场|九篇 Spotlight 论文,透视 AI 最前沿
7月7日,ICML 2026正会首日,雷峰网精选九篇Spotlight论文,涵盖生成模型、智能体系统等多领域。如SDEVI框架解决不规则时间序列生成难题,MASpoB让多智能体提示优化可行等。