缓存控制」共找到 557 篇相关文章

算法论文8

自回归模型杀回图像生成!实现像素级精准控制,比Diffusion更高效可控

当下AI图像生成领域,Diffusion模型虽为主流,但在精准控制上有不足。伊利诺伊大学香槟分校等机构研究者提出MENTOR框架,用自回归模型实现像素级精准控制,比Diffusion更高效可控。

量子位
算法论文7

减少检索增强生成(RAG)语义缓存中的误报:以银行业为例

文章围绕检索增强生成(RAG)语义缓存展开,指出其虽能提升效率,但设计不当会产生假阳性。以金融服务FAQ系统为例,经多组实验,发现缓存设计比模型优化更能减少假阳性,还给出未来架构路线图。

InfoQ
算法论文7

POF | 西北工业大学马榕池、高传强等:基于预解分析的圆柱绕流最优射流控制位置对雷诺数依赖性研究

本文提出预解分析有效增益指导控制位置量化设计方法,发现不同雷诺数下最优控制位置关系式,挖掘出射流与主流掺混作用的流动机理,即射流在科恩达效应有效行程内到分离点可最佳抑制涡脱。

力学与人工智能
产品应用7

一文搞懂Codex连接控制:iPhone,MacBook,Mac mini,远程服务器

文章详细介绍 Codex 连接控制的三类方式:把 Mac 当主机让其他设备控制、用 Mac 控制其他 Codex 主机、让 Codex 连接远程开发机/服务器,还提及相关设置及注意事项。

AI寒武纪
开源动态8

让本地大模型不再重复推理的缓存技巧

本地跑大模型时,同样问题换说法问,模型又要重新推理。`constraint-cache`这个Python库可解决此问题,它将语义相似查询规范化为统一缓存键,实现近乎即时的重复查询响应,还避免了随机性响应问题。

AI工程化
算法论文8

Cache Me If You Can:陈丹琦团队如何「抓住」关键缓存,解放LLM内存?

普林斯顿大学陈丹琦团队新论文聚焦长上下文语言模型 KV 缓存问题。传统 KV 缓存大小随输入文本长度线性增长,此前方法难公平比较。团队提出「KV 足迹」指标,改进方法并推出 PruLong 优化内存,节省空间且保性能。

机器之心
开源动态7

Pogocache:开源缓存软件实现低延迟并支持多传输协议

全新开源缓存软件 Pogocache 近日发布 1.0 正式版,主打低延迟与 CPU 高效能特性,支持多种主流通信协议,宣称比其他开源缓存方案有更高吞吐量和更低延迟。还介绍了其架构、应用场景等。

InfoQ
推荐文章7

TileLang深入详解-第三章-Kernel,Buffer,并行控制和矢量化

文章详细介绍TileLang核心编程构造,包括Kernel函数、Buffer和并行控制等。阐述其计算定义、并行与循环控制方式,还提及性能优化的矢量化访存,给出代码示例,并分享源码里形状、并行域和线程的最佳实践。

GiantPandaLLM
算法论文8

软体机器人控制难题获解,比传统方法节能75倍,还能闭眼干活

美国两校研究人员结合生物学与人工智能工程学,用‘神经储备池’技术控制生物混合软手臂,实现稳定追踪、自我感知和低能耗运行,还在多方面展现优势,目前研究处于仿真阶段。

DeepTech深科技
产品应用7

Seedance 2.5 抽卡老废片?专业团队的 4 层控制

Seedance 2.5上线后,单条画质好但成片易散架,废片率高。文章将官方提示词指南和一线分镜写法整合成四层控制框架,还给出30秒短剧分镜示例,助你定位问题、提高抽卡效率。

AI Reading Hub