「大记忆模型」共找到 9398 篇相关文章
有手就行,教你从0到1快速手搓搭建个GUI Agent
随着通用大模型发展,搭建GUI Agent难度降低。文章介绍如何用通用大模型API,从0到1搭建PC GUI Agent,包括原理、代码实现等,该Agent能跨应用操作,未来可强化功能。
让AI当「动作导演」:腾讯混元动作大模型开源,听懂模糊指令,生成高质量3D角色动画
3D角色动画创作面临成本高、数据稀缺等问题。腾讯混元团队研发的混元Motion 1.0动作生成基础模型于2025年12月30日开源,通过全链路算法创新,为3D角色动画生成确立新技术范式。
扩散模型自引导新范式:直接交换token就能变强! | CVPR‘26 Oral
上海交大和vivo研究者提出自交换引导(SSG),不依赖文本条件、不加噪声、不改模型,只交换token特征。在多数据集实验中,SSG表现超现有方法。不过,其缺理论支撑、计算开销大。
推理正确率下降65.5%!斯坦福、MIT等用「不等式」拷问AI逻辑极限
大语言模型在数学证明常现推理漏洞,斯坦福等高校团队提出IneqMath基准评估其严谨性。用不等式证明题切入,拆解为子任务,构建评测体系,用LLM - as - Judge审查。结果显示模型推理正确率低,存在结构性缺陷。
数字技术工人已到岗!时序大模型+Agent已掌握了工厂生产管控技术,比人类更懂工况
基于时序大模型和Agent的数字技术工人,能承担生产操作等关键任务,接手复杂工业环节。国内AI团队打造的河谷平台构建智能体,自研底层技术,以工艺维度训练,上岗快,极峰科技还创新商业模式。
Energy | 西工大史子颉、高传强等:三维风力机叶片动态失速数据融合建模研究
动态失速威胁风力机叶片安全与发电效率,传统模型有局限。西工大团队开发数据融合神经网络与动量叶素理论耦合框架,能高效高精度预示三维叶片动态失速,虽部分工况有偏差,但预测精度显著提升。
500万次围观,1X把「世界模型」真正用在了机器人NEO身上
1X公司为机器人NEO引入1X World Model,使其学会‘想象’。该模型借助视频预训练,不依赖大规模机器人数据和遥操作演示,能泛化到新场景。实验显示其在多任务上表现不错,但精细操作有挑战。
梁文锋署名!DeepSeek再发炸裂论文:提出“条件记忆”新范式,彻底打破GPU推理显存墙
来自DeepSeek的新论文提出“条件记忆(Conditional Memory)”新范式,推出Engram模块,实现可扩展知识查找。研究揭示U形缩放定律,构建的Engram模型性能超越纯MoE基线,还打破了GPU显存瓶颈。
三大头部互联网企业交锋,AI时代可观测边界出现了吗?
InfoQ《极客有约》X AICon 直播栏目邀阿里云张城等探讨AI时代可观测新边界。嘉宾们认为AI与可观测技术双向赋能,传统算法与大模型互补,未来有望实现半自治运维,还分享了数据治理等经验。
AI 也有长久记忆了!谷歌Nested Learning让AI拥有持续学习的生命力
Google Research科学家研究直指AI领域难题,其论文《Nested Learning: The Illusion of Deep Learning Architectures》已提交NeurIPS 2025。Nested Learning打破认知框架,提出三大核心贡献,构建HOPE架构,性能优越,将改变终身学习应用领域。