向量化查询引擎」共找到 606 篇相关文章

产品应用8

Couchbase与爱奇艺的十年之约:Magma引擎如何破解TB级缓存性能与成本难题?

在AI驱动应用革新浪潮下,海量数据处理的性能与成本平衡成挑战。Couchbase技术直播中,爱奇艺专家分享实践经验,揭秘其如何破解性能、扩展性与成本难题,还介绍了Capella AI Services等。

InfoQ
开源动态8

狂揽17.1K Star!!开源逆向工程神器,Rizin引擎驱动、跨平台调试反编译、图形化操作,爽翻了!

在信息安全等领域,传统逆向工具价格贵或操作复杂。开源君分享免费开源逆向工程神器Cutter,由Rizin框架驱动,有强大功能与现代化界面,在GitHub获17.1K Star。

开源先锋
7

【博客转载】CUDA Vectorized Memory Access (文末送书)

文章展示如何用向量化内存访问提高CUDA函数有效内存带宽,实现朴素自定义设备内存拷贝函数,对比不同数据类型、大小及方法的性能,得出拷贝数据单元多、单元大及以8或16字节向量化单元拷贝可提升带宽等结论。

GiantPandaLLM
开源动态8

Transformers来到了v5时代:从工具包到真理之源,AI时代的操作系统内核的极简进化论

Transformers v5发布,通过极简定义和极致互通成AI生态核心。它做减法重构代码、拓展训练流程、成推理引擎弹药库、提升量化为核心功能,连接训练、推理与部署,是AI生态通用语言。

AIGC开放社区
新闻资讯7

DeepSeek刚提到FP8,英伟达就把FP4精度推向预训练,更快、更便宜

DeepSeek提及针对国产芯片的FP8量化设计,引发对大模型量化策略关注。不久后英伟达发力低精度量化,将NVFP4策略拓展到预训练阶段,其方案能解决核心挑战,实验证明NVFP4在大规模训练中可行。

机器之心
算法论文8

挑战 1 比特!ETH Zürich 秦浩桐:如何把大模型「塞进」小设备?| IJCAI 2026

IJCAI 2026大会上,秦浩桐给出创新解法,挑战无需重训的“后训练量化”极限,将庞大的LLM强行压缩至极端的1比特与2比特。其团队的BiLLM与SqueezeLLM打破了后训练量化魔咒,还指出极低比特量化的三大挑战。

AI科技评论
新闻资讯8

9位顶级研究员连讲3晚,华为盘古大模型底层研究大揭秘

华为诺亚方舟实验室成果颇丰,4月开发千亿级通用语言大模型Pangu Ultra,5月推出稀疏大语言模型Pangu Ultra MoE。5月28 - 30日,机器之心联合举办分享会,9位研究员揭秘量化、剪枝等关键技术突破。

机器之心
算法论文8

快慢Reasoning综述!

大型语言模型在复杂推理任务中有‘无差别计算’缺陷,阻碍其在多场景应用。本文提出双层效率优化框架,梳理两类前沿技术,通过实验揭示瓶颈,为轻量化推理指明路径。

深度学习自然语言处理
开源动态8

深度拆解,硬核解构,揭开vLLM推理系统实现高效吞吐的秘籍

文章深度拆解 vLLM 推理系统,介绍其核心组件和高级特性,包括推理引擎流程、调度机制、高级功能等,还提及系统扩展、分布式部署、性能测量等内容,助力读者理解推理引擎工作原理。

机器之心
开源动态7

扣子要做 Agent 时代的 Infra,附开源版搭建全流程

扣子宣布开源 Coze Studio,后端用 Golang,前端用 React 和 TypeScript,基于微服务架构。借助火山引擎 ECS 可一键部署,还能更换自定义模型。官方表示开源是为顺应趋势、确保安全及获开发者反馈。

特工宇宙