「高效注意力机制」共找到 1489 篇相关文章
「Memory as a Context」是否将重新定义 Transformer 的 「记忆模式」?
本期机器之心PRO会员通讯解读3个AI业内要事,包括「Memory as a Context」能否重新定义Transformer记忆模式、世界模型发展情况,以及OpenRouter联合a16z发布的《State of AI》报告。详细探讨了谷歌Titans架构及其理论框架MIRAS,还提及业界对LLM记忆力的改进方案。
谷歌新架构突破Transformer超长上下文瓶颈!Hinton灵魂拷问:后悔Open吗?
谷歌在NeurIPS 2025发布两项大模型新架构研究,通过‘测试时训练’机制,推理阶段可将上下文窗口扩展至200万token。新成果Titans和MIRAS结合RNN速度与Transformer性能,突破超长上下文瓶颈。
Anthropic官宣PTC突破,中国开发者一年前就实现了
2025年11月24日,Anthropic发布PTC特性,让Claude通过代码编排工具执行。但国产minion框架早有类似架构,不仅将此作为基础架构,还支持Python生态、状态管理等功能,在实际应用中更高效灵活。
告别「一条路走到黑」:通过自我纠错,打造更聪明的Search Agent
为解决知识实时性和推理复杂性挑战,搜索智能体(Search Agent)应运而生,但缺乏自我纠错能力。腾讯联合清华提出 ReSeek 框架,引入动态自我修正机制,还构建 FictionalHot 数据集评估,实验效果良好。
谁杀死了那篇好论文?AI顶会乱象:好文被刷,低分论文捧上天
一位AAAI 2026审稿人在Reddit匿名爆料,称评审流程乱象丛生,好论文被拒、弱论文晋级,还有疑似“关系稿”。AAAI启用AI辅助审稿系统,本意提升效率,却让评审更不可控,侵蚀学术信任。
后端架构新范式!阿里云专家亲揭:用RocketMQ彻底搞定多Agent异步协同难题
文章整理自阿里云专家演讲,介绍基于 Apache RocketMQ 新特性构建异步化 Multi - Agent 系统,探讨 Agent 间异步通信等机制,指出 Multi - Agent 协同关键,还讲了 RocketMQ 新特性及如何构建异步系统。
AI百科全书SciencePedia:当马斯克Grokipedia遭遇滑铁卢,有个中国团队默默把活儿干了
在知识爆炸时代,传统互联网平台难以满足用户获取深度见解的需求,马斯克的Grokipedia也未达预期。深势科技等团队推出SciencePedia,它能理解知识关系,追踪科学脉络,让真知高效抵达用户。
DeepMind再登Nature:AI Agent造出了最强RL算法!
Google DeepMind团队提出DiscoRL,让智能体在多环境交互中自主发现强化学习规则,无需人类设计。它在Atari基准中击败MuZero,在未见过的游戏中也稳定高效,相关研究登《Nature》。
Karpathy 评 DeepSeek-OCR:分词器必须消失!马斯克:光子才是 AI 的终极语言
Andrej Karpathy 发长文讨论 DeepSeek - OCR 论文,提出图像输入比文本更高效,还表达对分词器的厌恶,认为其必须消失。马斯克称 AI 主要交互将是视觉。开发者分享实践经验,也有人提出质疑。
Nature点赞!哈佛MIT最新作:AI科学家时代来了
哈佛MIT推出ToolUniverse,这一开源框架让AI用自然语言操作600+科学工具,解决了科学研究中AI智能体面临的工具格式不统一等问题,推动科研自动化升级,助力打造AI科学家。