「电脑内存」共找到 348 篇相关文章
WebAssembly 3.0 发布,64 位内存、垃圾回收全都有,先别激动,组件模型还没做完!
WebAssembly 3.0 发布,有 64 位内存、垃圾回收等特性,但备受期待的组件模型未完成。虽未迎来‘Docker 时刻’,但服务器端生态有进展,不少平台已实现‘类组件’能力。
谷歌一篇论文引爆存储芯片崩盘!AI内存需求暴降6倍,推理狂飙8倍
谷歌发布TurboQuant算法,将缓存压到3 - bit,内存占用降为1/6,推理速度提升8倍。该算法冲击存储巨头,引发股价下跌,虽目前未改变采购量,但改写推理成本,且从论文到落地的路在缩短。
非Transformer架构的新突破,液态神经网络的推理小模型只用900M内存
谷歌提出的Transformer架构基本垄断大模型,而初创公司Liquid AI研发的液态神经网络架构另辟蹊径。其发布并开源的LFM2.5 - 1.2B - Thinking模型,仅需900MB内存就能在端侧运行,性能优于Transformer架构模型,还降低了死循环生成比例。
3D高斯泼溅,可输入视图量高达500!推理速度提升3倍,内存少80%
ZPressor能高效压缩3D高斯泼溅(3DGS)模型的多视图输入,解决其在处理密集视图时的性能瓶颈。它基于信息瓶颈原理,分三步压缩信息,降低内存占用和推理时间,提升3DGS在高视图输入下的性能。
“我让AI在我的电脑上为所欲为!”MoltBook创始人:爆火的技术,其实简单到离谱
MoltBook创始人Peter Steinberger称其是OpenClaw的延伸,外界对它解读“戏剧化”,但从技术角度看没什么震撼之处。真正关键的是敢让模型在电脑上自由运行,他还想让Agent“做梦”,项目会保持开源。
AI 本地跑?Google 新开源模型上线,本地量化后占用不到 200MB 内存,支持百余语言
Google DeepMind推出开源嵌入模型EmbeddingGemma,专为本地设备高效运行设计。它用Matryoshka方法和量化感知训练,提升效率。在MTEB测试中成绩佳,支持百余种语言,内存占用少,已集成多种工具。
OpenClaw逼出Claude最强反击!GUI操控电脑和真人无差别,网友:这得花多少token?
Claude Code升级Computer Use能力精准反击OpenClaw,基于GUI操作,像真人操控电脑。升级后无需API或CLI改造,能操控传统软件,还上线远程控制、定时任务功能,有安全分层设计。已向Claude Pro和Max用户开放。
阿里通义发布并行计算新策略:1.6B等效4.4B,内存消耗骤降95%
阿里通义团队提出PARSCALE并行计算新策略,受CFG双路径推理机制启发,将并行思想扩展到训练和推理全流程。能让1.6B模型性能接近4.4B模型,内存占用大降,还可用于现有模型,无需从头训练。
五一我没开电脑,但我的 Agent 团队没放假 | 如何用Hermes Agent移动办公
作者五一旅行未开电脑,但工作未停,靠Hermes Agent移动办公。介绍了其基本链路,还将Agent分工,如个人助理、内容总监等,也提到多Agent群聊协作,最后指出一人公司用Agent需明确流程、完善知识库,人要做好判断。
2G 内存跑 Gemma 3n 完整版!全球首个 10B 内模型杀疯 LMArena:1300 分碾压记录
当地时间6月26日,谷歌正式发布Gemma 3n完整版,可在本地硬件运行。它是开源大模型,具多模态能力,最低2GB内存设备就能跑,E4B模型LMArena测评表现佳,还有MatFormer架构等多项创新。