进化机制」共找到 1443 篇相关文章

算法论文8

ICML 2025 | 注意力机制中的极大值:破解大语言模型上下文理解的关键

ICML 2025新研究揭示,在使用RoPE的现代Transformer模型里,注意力机制Q和K表示有集中极大值,V表示无此模式。研究通过实验明确极大值与上下文知识理解的联系,对模型设计、优化和量化有重要启示。

深度学习自然语言处理
新闻资讯8

赌自己会失业!田渊栋八人天团狂揽44亿元,杀入「递归进化」赛道

Recursive Superintelligence由八位顶尖AI研究员创立,获GV、英伟达等投资6.5亿美元。他们要让AI自我训练,实现递归自我进化,若成功或使AI研究员岗位消失。此前已有相关成果,产品端Anthropic也在推进AI主动性。

新智元
算法论文8

10行代码,AIME24/25提高15%!揭秘大模型强化学习熵机制

来自多机构的研究者揭示大模型强化学习中熵变化机制。发现策略熵在训练中急剧下降致性能停滞,提出 Clip - Cov 与 KL - Cov 两种正则化技术调控高协方差标记,遏制熵塌缩,在部分数据集上性能提升显著。

机器之心
新闻资讯7

当 Agent 开始接管工作流,企业最在意的三件事:安全运行、稳定交付、持续进化

Agentic AI 开发落地使基础设施问题凸显。AI 产业转向重视模型部署等,CPU 受关注,云计算角色转变,容器重要性凸显。Agent 应用规模化落地,AI 负载变化,Agent Infra 要解决四个问题,云和 CPU 任务也在改变。

InfoQ
产品应用8

生成率从8%到60%:快手智能测试用例生成系统的四阶进化

快手研发效能团队构建智能用例生成系统,实现从手动编写到审核校验的模式转变。该系统历经四阶架构演进,将用例生成率从 8% 提升至 60% 以上,成为公司测试人员日常使用的标准化生产力工具。

InfoQ
算法论文8

2026 AI Memory最新综述:从理论到实战,一文读懂AI记忆的进化全景

2026年北邮百家AI MemoryOS团队联合华为发表《Survey on AI Memory》,涵盖AI记忆理论基础、分类体系、架构、评估方法与前沿趋势,还提出4W分类法,剖析了发展挑战与未来方向。

PaperAgent
算法论文8

英伟达港大联手革新视觉注意力机制!GSPN高分辨率生成加速超84倍

香港大学与英伟达联合推出广义空间传播网络(GSPN)。它采用二维线性传播与“稳定性 - 上下文条件”,将计算量降低,保留图像空间连贯性。在多视觉任务刷新性能纪录,如高分辨率生成加速超84倍。

量子位
算法论文8

Transformer已死?DeepMind正在押注另一条AGI路线

谷歌团队借鉴人类联想记忆,提出嵌套学习,解决AI「灾难性遗忘」问题。强调优化器与架构协同进化,构建联想记忆系统。HOPE架构在多任务表现出色,或开启AI从被动训练到主动进化大门。

新智元
开源动态8

X 推荐算法开源,暴力拆解推荐机制,这是内容创作者的终极流量增长秘籍。

马斯克兑现承诺,将X推荐算法开源。文章用通俗语言介绍其运作原理,把推荐系统比喻成两个‘内容买手’和一个‘裁判’,还给出内容评分标准、过滤机制及创作者提升流量的实战建议。

开源AI项目落地
推荐文章7

2026年必须搞懂的20个 Agent 工程概念(运行机制篇):大白话一次讲清。

文章聚焦Agent工程运行机制,介绍20个核心概念。如Agent与ChatBot区别在于会‘做’;Harness是模型运行框架;Execution Model决定思考行动范式等,还给出各概念工程实践建议。

AI大模型应用实践