「记忆起源大赛」共找到 631 篇相关文章
GPT5.5 + Codex 如何跑一整夜,编程的下一步,不是辅助编程,是可托管执行单元
文章指出GPT - 5.5在Codex里展现出强大自主性,能处理长时程任务。还介绍让其跑长任务的方法及面临的问题,强调长任务需状态机、证据链等,社区也在构建相关工作流层。
Claude Opus 4.7来了,公开模型里的SOTA!不过用起来GPT味好浓
Anthropic推出Claude Opus 4.7,虽有像GPT的争议,但在多方面表现出色。它在高级软件工程、视觉能力等四大方向升级,且具备防护措施和记忆增强。全平台开放,与Opus 4.6同价,使用有注意事项。
Agent搜索哪家强?人大高瓴&快手联合发布全新评测基准GISA
人大高瓴与快手联合发布全新评测基准GISA,用于评估智能体搜索能力。它解决了现有基准反向构造、评估维度单一、答案易被记忆等问题,含373个高质量查询,实验显示当前搜索智能体距人类水平差距大。
阿里开源 Team 版 OpenClaw,5分钟完成本地安装
阿里开源 Team 版 OpenClaw——HiClaw,它是 OpenClaw 超进化版,引入 Manager Agent 角色,解决了 OpenClaw 在安全、多任务协作、移动端体验、记忆管理等方面的痛点,还集成多个开源组件,部署简单,适合开发者和企业。
MotlBot作者被Claude刁难后:MiniMax M2.1是最优秀的开源模型
Moltbot热度不减,开发者挖掘其实用价值,阿里云、腾讯云上线相关云服务。Moltbot作者Peter接受采访,分享项目起源、开发思路等,认为MiniMax M2.1是优秀开源模型,还探讨了智能体发展及项目后续规划。
刚刚,DeepSeek 突发梁文峰署名新论文:V4 新架构提前曝光?
今天凌晨,DeepSeek在其GitHub官方仓库开源了新论文与模块Engram。该论文提出“查—算分离”机制,通过引入可扩展的查找记忆结构,在等参数、等算力条件下提升模型表现,代码与论文全文均已开源。
Chrome已死,AI浏览器当立!认知革命比技术成熟来得更快。
文章指出AI浏览器重新定义底层逻辑,从导航工具变为执行意图的引擎,有持续意图记忆等核心能力。即便成功率不高,用户也易完成认知转变,还总结了AI产品团队应知道的规律及失败类型。
收手吧GPT-5-Codex,外面全是AI编程智能体!
OpenAI推出专为智能体编程设计的GPT-5-Codex,其在代码重构、审查和缺陷发现上表现提升,具动态资源分配机制。文中还提及Codex起源、Harness概念及OpenAI内部工具,当前编程智能体竞争激烈。
4比0横扫Grok 4,o3强势夺冠,首届大模型对抗赛结果出炉
备受AI圈关注的首届谷歌Kaggle AI Chess大赛落幕。o3以4 - 0横扫Grok 4夺冠,Gemini 2.5 Pro 3.5 - 0.5击败o4 - mini获季军。此前Grok 4被视为夺冠热门,决赛却频频失误。
Skill vs App:一场入口范式的争夺
量子位举办的「龙虾时代,Skill会吃掉App吗?」主题沙龙上,多位从业者围绕Agent生态、Skill能力边界、App未来形态等话题展开讨论。指出Skills不会完全干掉App,App会以Skill形式继续存在并进化,还探讨了App在AI时代的多种走向及面临的问题。