激活值内存」共找到 633 篇相关文章

8

谷歌公开全新极限压缩算法:LLM提速8倍、内存占用狂降6倍,精度零损失

谷歌推出全新量化算法 TurboQuant,瞄准大模型键缓存吃内存、高维向量搜索算力瓶颈痛点,能砍内存、提速度且精度零损失。分 PolarQuant 和 QJL 两步,实验数据表现优异,将改变搜索格局。

AI寒武纪
算法论文8

谷歌新论文把内存股价干崩了!KV cache压缩6倍,“谷歌的DeepSeek时刻”

谷歌研究院推出TurboQuant压缩算法,可将AI推理中最吃内存的KV cache压缩至少6倍且精度零损失,还能8倍加速计算。虽引发存储芯片巨头股价下跌,但目前只是实验室成果,仅解决推理阶段内存问题。

量子位
新闻资讯7

奥特曼出新招防挖角!员工期权变钞票,按5000亿美元估兑现

被挖怕了的奥特曼开启新一期员工期权兑现计划,按5000亿美元估兑现。这一计划若推进,既能留人,也能推高OpenAI估。目前OpenAI发展态势好,但也面临与微软谈判等挑战。

量子位
新闻资讯7

AI 圈现“教科书式”骗局:对外伪造千亿估,对内裁员、四次爽约,投资人员工双双被套

2025年初,Infinite Reality宣布获30亿美元融资,自报估飙升至155亿美元,引发质疑。其高估存疑,30亿美元融资真实性未知,CEO履历也有疑点。11月股东会称33.6亿美元投资或不到账,还取消股份回购,已四次食言,目前遭监管调查。

InfoQ
新闻资讯7

谷歌迎来“DeepSeek时刻”!TurboQuant引爆AI圈、全球开发者疯狂复现:6倍无损压缩,内存股集体暴跌

谷歌研究院发布 TurboQuant 压缩算法,能在提升速度、保持准确性的同时,降低大语言模型内存占用,可将键缓存压缩至少 6 倍,速度最高提升 8 倍。该技术无需额外训练,精度零损失。目前虽未大规模部署,但已引发内存股下跌。

AI前线
新闻资讯7

抱抱脸要卖了:估超 130 亿美元

Business Insider称,Hugging Face(抱抱脸)正找买家,估超130亿美元,公司未回应。它从聊天App转型成模型市场,虽没自研模型,但汇聚众多模型。目前出售有多种可能走向。

AGI Hunt
产品应用7

Supabase:百亿美元估,vibe coding 的默认后端?

Supabase 以 Postgres 为核心,提供一站式后端服务,接近完成 5 亿美元 F 轮融资,估 100 亿美元。它处于 Postgres 生态和 AI coding 趋势交叉点,产品路线图向 agent 倾斜,面临竞争、UE 等挑战。

海外独角兽
新闻资讯7

Claude估暴涨300%!全球独角兽字节第三他第四

Anthropic官宣完成F轮130亿美元融资,最新估达1830亿美元,比上轮暴涨近300%。成立4年成全球第四大估初创公司,Claude Code年收入破5亿美元,融资用于拓展业务与海外推广。

量子位
新闻资讯8

美光财报:这一次,内存行业真的不一样了

美光财报表现亮眼,单季营收414亿美元,同比暴涨346%,毛利率从38%飙升到85%。AI让内存成战略资源,需求爆发,供给受限。美光扩产激进、技术进步快,有望进入‘以利润养扩产’正循环。

newtype AI
算法论文8

Cache Me If You Can:陈丹琦团队如何「抓住」关键缓存,解放LLM内存

普林斯顿大学陈丹琦团队新论文聚焦长上下文语言模型 KV 缓存问题。传统 KV 缓存大小随输入文本长度线性增长,此前方法难公平比较。团队提出「KV 足迹」指标,改进方法并推出 PruLong 优化内存,节省空间且保性能。

机器之心