内存管理」共找到 714 篇相关文章

开源动态7

让Agents更聪明,3招搞定记忆管理~

文章深度分析开源项目Memori,探讨Agent记忆管理。它将记忆分短期和长期,通过三个Agent协同工作实现长短期记忆功能,使记忆成结构化知识库,且能无缝衔接多种API。

探索AGI
新闻资讯7

微软预览 Foundry Agent Service 长期记忆功能,简化状态管理

在年度 Ignite 大会上,微软宣布公开预览 Foundry Agent Service 中的记忆功能,这是全托管长期记忆存储,与代理服务原生集成。开发者可存储、检索和管理关键上下文,系统自动处理复杂“管道”。

InfoQ
新闻资讯8

美光财报:这一次,内存行业真的不一样了

美光财报表现亮眼,单季营收414亿美元,同比暴涨346%,毛利率从38%飙升到85%。AI让内存成战略资源,需求爆发,供给受限。美光扩产激进、技术进步快,有望进入‘以利润养扩产’正循环。

newtype AI
算法论文8

Cache Me If You Can:陈丹琦团队如何「抓住」关键缓存,解放LLM内存

普林斯顿大学陈丹琦团队新论文聚焦长上下文语言模型 KV 缓存问题。传统 KV 缓存大小随输入文本长度线性增长,此前方法难公平比较。团队提出「KV 足迹」指标,改进方法并推出 PruLong 优化内存,节省空间且保性能。

机器之心
新闻资讯8

OpenAI奥特曼认错:我天生不适合管理公司

OpenAI CEO奥特曼在a16z采访中回应热点问题,阐述三大核心战略,谈及Sora 2等热点话题,还称自己不适合管理公司。他提到目标、对垂直整合看法、Sora与AGI关系等内容。

量子位
产品应用7

jiSGLang集成ktransformers:2TB内存运行Kimi K2 Thinking模型

对于内存多但GPU资源有限的用户,SGLang集成ktransformers的CPU内核,支持直接运行Kimi K2 Thinking模型。它无需等量化,还能微调,虽性能与GPU方案有差距,但给用户新选择。

AI工程化
新闻资讯7

英伟达服务器涨价超15%!百亿AI基建的「内存难题」

据彭博社报道,英伟达通知客户,搭载其AI芯片的服务器价格将涨超15%,2027年初生效。涨价主因是内存需求大增、供应紧张价格上涨,这让数据中心前期投入增加,小公司更难入局。

机器之心
产品应用8

一条SQL管理向量全生命周期,让AI应用开发更简单

在大模型驱动的AI浪潮中,向量在AI应用开发中至关重要,但开发者面临技术栈分裂等隐形成本。PolarDB IMCI提出解决方案,在数据库内核集成向量索引与Embedding能力,用一条SQL管理向量全生命周期,降低开发和维护门槛。

阿里云开发者
算法论文8

50年僵局打破!MIT最新证明:对于算法少量内存胜过大量时间

MIT理论计算机科学家Ryan Williams最新研究建立数学程序,将任意算法转化为占用空间更少的形式,证明少量计算内存比大量计算时间更有价值,打破计算机科学家近50年认知。

机器之心
算法论文7

60个量子比特顶百万倍内存:量子机器学习找到新的突破口

4月8日,加州理工学院等联合团队在arXiv发布论文,证明小型量子计算机处理部分机器学习任务时,可用指数级更少内存超越经典计算机。研究绕开QRAM,提出算法框架验证优势,但仍待真实硬件验证。

DeepTech深科技