「外部记忆系统」共找到 2186 篇相关文章
只要科学任务能打分,AI就能实现SOTA结果 | 谷歌最新论文
谷歌最新论文提出,只要科学任务可评分,用大模型+树搜索,让AI大海捞针,就能找到超越人类专家的方法实现SOTA结果。他们开发的AI系统在多领域发明新方法,都达SOTA水平。
SPIRAL:零和游戏自对弈成为语言模型推理训练的「免费午餐」
新加坡国立大学等机构团队提出 SPIRAL,让模型在零和游戏自对弈强化推理,摆脱人工监督。研究发现游戏可培养推理能力并迁移到数学,还开发系统保障训练,虽有局限但为 AI 发展指明方向。
狂奔AGI,Claude年终封王!自主编码近5小时震惊全网
METR报告称Claude Opus 4.5能持续自主编码5小时,超OpenAI最强编程模型。AI编码智能体任务时长指数级增长,不过迈向AGI仍面临长期记忆难题,未来一年该领域或有突破。
两个LLM互相对线,推理能力起飞:康奈尔团队发布大模型版类GAN训练法
康奈尔大学团队提出面向大语言模型的类GAN训练框架PasoDoble,通过对抗训练两模型提升推理能力,不依赖外部监督,在多模型实验中显著提升数学基准表现,不过在部分领域外任务有局限。
为什么95%的智能体都部署失败了?这个圆桌讨论出了一些常见陷阱
硅谷圆桌论坛指出,95%的AI智能体部署失败,原因并非模型不智能,而是基础框架、上下文工程等未成熟。还探讨了上下文工程实践、信任治理、记忆设计、多模型编排等问题,给出创业者需思考的问题。
打开高德的理由又多一条!全球首个「需求链智能调度」AI地图上线
8月,全球首个AI原生地图应用——高德地图2025上线。它有「需求链智能调度」系统,能处理多任务出行。其ST - MAC技术可解构复杂请求、构建群体智能服务生态,还有时空感知、AI探索等功能。
模拟大脑功能分化!北大与港中文发布Fast-in-Slow VLA,让“快行动”和“慢推理”统一协作
北大与港中文研究团队发布 Fast-in-Slow(FiS-VLA)全新双系统视觉 - 语言 - 动作模型,将快速执行模块嵌入预训练视觉 - 语言模型,实现快慢系统一体化。该模型在多平台表现优异,控制频率大幅领先。
别只做skill了,都去做插件吧
Claude Code的插件系统上线,解决了配置难分享、版本化和审核的问题。它将已有能力标准化,介绍了插件与独立配置选择、上手步骤、可装内容、测试方法、提交市场及从独立配置迁移等内容,还提及其他软件推插件市场。
揭秘!腾讯如何训练多智能体像专家一样设计游戏场景
腾讯游戏提出游戏场景自动布局生成系统IntelliScene 2.0,利用图像引导生成3D场景。它构建多智能体工作流,结合高质量数据集,经模型微调、视觉解析等步骤生成场景,经评估效果良好,为AI生成三维信息提供新路径。
鼠标的未来是手环?解码肌肉信号,Meta黑科技登上Nature
Meta推出非侵入性神经肌肉交互系统,利用手腕表面肌电图(sEMG)实现人机交互,该技术登上7月24日的Nature。实验在连续手势控制、离散手势控制和打字三个任务评测效果不错,适合特殊人群,也能弥补脑机接口数据不足。