存储计算融合」共找到 1308 篇相关文章

算法论文7

一篇持续强化学习技术最新综述

文章对持续强化学习(CRL)进行全面考察,关注其核心概念、挑战和方法,提出新的分类体系,从知识存储和/或转移角度将CRL方法分为四类,并分别介绍各类方法特点。

PaperAgent
算法论文8

世界首个!李飞飞团队推出物理推理基准,大模型统统不及格?

斯坦福联合中科大团队推出世界首个评估视觉语言模型物理推理能力的基准QuantiPhy,通过测试发现顶尖模型在数值计算上不如人类,还揭示模型推理靠记忆而非测量,为AI发展指明方向。

AIGC开放社区
开源动态8

集GraphRAG 和 DeepSearch于一体的智能问答系统graph-rag-agent

本项目结合GraphRAG与私域Deep Search,实现可解释、可推理的智能问答系统。亮点有从零复现GraphRAG、创新融合DeepSearch等,具备多模块功能,还有简单演示,地址https://github.com/1517005260/graph-rag-agent/blob/master/readme.md。

GitHubStore
算法论文8

DeepSeek发布最新论文,5大杀手锏让大模型训练、推理暴涨

全球著名开源大模型平台DeepSeek在huggingface发布超强开源模型V3的论文,从硬件架构和模型设计双视角探讨高效训练和推理,提出DeepSeek - MoE、多头潜在注意力等创新技术,解决内存、计算效率等难题。

AIGC开放社区
新闻资讯7

刚刚,DeepSeek新模型MODEL1曝光,3处架构升级!

DeepSeek更新FlashMLA时曝光新模型MODEL1,从diff看它在MLA KV-Cache存储与访问方式上和V3/V3.2系列有3个本质差异,如物理排布更紧凑、引入‘extra’两段式cache、头维固定512×512。

PaperAgent
开源动态8

SGLang Hierarchical Sparse Attention 技术深度解析

阿里云等团队推出面向 Sparse Attention 的分层稀疏化框架,介绍其架构、机制与实践。此框架破解了长上下文推理时的计算与容量瓶颈,以 DeepSeek DSA 集成测试,使推理性能大幅提升,目前项目处于开发阶段。

阿里云开发者
算法论文8

英伟达、港大等发布创新KV缓存,实现扩散模型无训练加速

多数开源扩散语言模型推理效率不如自回归模型,英伟达、港大、麻省理工研究人员联合提出Fast - dLLM。它用近似KV缓存机制减少冗余计算,还提出基于置信度的平行解码策略,测试显示能加速且保持生成质量。

AIGC开放社区
新闻资讯8

斯坦福吴佳俊「计算机与思想奖」获奖演讲全文:从一张照片,逆推一个世界|IJCAI 2026

8月20日,斯坦福大学吴佳俊在IJCAI 2026发表“计算机与思想奖”获奖演讲。他指出像素是表象,物理结构才是因果,提出以物理代码为桥,融合基础模型泛化力与物理模拟因果性,构建视觉与物理智能。

AI科技评论
算法论文8

强化学习远不是最优,CMU刚刚提出最大似然强化学习

CMU等机构研究指出,现实中广泛使用的强化学习未真正做最大似然优化,只是优化其一阶近似。基于此,团队提出最大似然强化学习,实验显示其在性能与计算效率权衡上优于现有方法。

机器之心
算法论文8

邱锡鹏团队新作:让机器人学会「察言观色」

复旦大学邱锡鹏团队等发布全新操作框架 RoboOmni,突破传统 VLA 依赖显式指令局限。它融合多模态信号,构建数据集,在成功率等方面超基线,以跨模态指令让机器人主动推断意图,开启具身智能‘共情时代’。

AI科技评论