类LLM机制」共找到 1976 篇相关文章

算法论文8

AI记忆系统首获统一框架!6大操作让大模型拥有人记忆能力

香港中文大学等团队发布AI记忆机制综述,首次构建统一框架,划分记忆型,提出六种操作,探讨关键主题,还对比人与AI记忆,指明未来AI记忆系统需突破瓶颈,迈向认知跃迁。

量子位
新闻资讯8

赛博义父Tibo最新访谈:专门实体按钮搞重置,“我想重置就重置”

赛博义父Tibo在播客中透露诸多OpenAI内幕,如ChatGPT和Codex将融合成个人化AGI,下一代Agent核心是机制“消失”等,还回顾谷歌经历,分享OpenAI文化、产品发展等观点。

量子位
产品应用8

MySQL复制延迟终结者:AliSQL 高效AI诊断和四大内核级优化

MySQL主从复制延迟损害实例可用性和时效性。AliSQL引入AI诊断定位原因,针对大表DDL、大事务、批量数据处理和小事务高并发四场景,进行内核级优化,消除复制延迟。

阿里云开发者
算法论文8

Communications Engineering | 西湖大学&女王大学:面向阵风气动建模的表面压力时空动力学关联研究

西湖大学联合女王大学团队提出 Graph Transformer 框架用于阵风气动建模,融合图神经网络与注意力机制,从表面压力信号学时空关联,实现气动力准确预测,为AI在复杂气动建模提供新思路。

力学与人工智能
算法论文8

DeepSeek-V4蓄势待发!梁文锋署名论文或开启第二个DeepSeek时刻

据报道,DeepSeek将于2月发布新一代旗舰模型DeepSeek V4,其编程能力或超Claude和GPT系列。最新论文提出Engram条件记忆机制,分离死记硬背与逻辑推理,揭示新稀疏性分配定律。

AIGC开放社区
推荐文章8

社会身份的价值:从专业证书到个人品牌,如何最大化你的身份价值?深度拆解知识博主、行业协会KOL的崛起之路

报告解构社会身份资本体系,指出当代职业人士面临制度化与涌现性资本抉择。梳理五身份资本,分析投入产出比,强调结合两者实现杠杆效应,还探讨了AI时代身份价值重塑。

AI Reading Hub
算法论文8

哈工大最新研究AI Meets Brain

传统大模型有“健忘”问题,哈工大《AI Meets Brain》研究借鉴人记忆机制,为AI智能体打造强大记忆系统。研究涵盖核心洞察、记忆形态、分框架等内容,还探讨了记忆赋能方式及未来发展方向。

CourseAI
算法论文8

清华、快手提出AttnRL:让大模型用「注意力」探索

清华和快手团队提出新框架AttnRL,引入注意力机制提升过程监督强化学习效率与性能。它解决传统方法在分支位置选择和采样策略上的效率问题,实验显示在多基准测试中表现优异。

机器之心
算法论文8

腾讯混元TurboS技术报告首次全公开:560B参数混合Mamba架构,自适应长短链融合

腾讯公开混元TurboS技术报告,该模型是超大型Hybrid Transformer - Mamba架构MoE模型,融合Mamba与Transformer架构优势,有自适应长短思维链机制,激活参数56B。在多评测中表现佳,推理成本低。

AI前线
算法论文8

快9倍还更清晰?Direct3D-S2一键解锁高效3D生成

在高分辨率三维形状生成中,传统方式有计算与内存瓶颈。南京大学提出Direct3D - S2框架,基于稀疏体积构建,有空间稀疏注意力机制,加速计算,还引入统一格式VAE,生成质量领先,训练成本更低。

带你学AI