「检索延迟」共找到 458 篇相关文章
中心动态重分配哈希,北邮团队提出并开源CRH项目 | AAAI 2026
北京邮电大学等机构联合提出新颖端到端框架 CRH,在训练哈希函数时动态更新哈希中心,提升检索精度和语义一致性。论文被 AAAI 2026 收录,代码已开源。
「Tokens是胡扯」,Mamba作者抛出颠覆性观点,揭露Transformer深层缺陷
Mamba作者Albert Gu在博客中探讨状态空间模型(SSM)和Transformer权衡,抛出‘Tokens是胡扯’观点,揭露Transformer深层缺陷,如分词问题、处理噪声能力弱等,还分析两类模型特点及结合优势。
MariaDB LTS 年度发布集成了向量搜索
MariaDB发布2025年度LTS版本11.8,引入集成向量搜索功能,适用于AI驱动和相似性搜索应用。还增强了JSON功能,提供时态表。新向量数据类型利于机器学习等应用,同时解决了2038年问题。
阿里Qwen3一口气开源多个向量&排序模型,冲!
今天阿里正式开源Qwen3-Embedding和Qwen3-Reranker系列,为多语言文本嵌入和相关性排序树立新标杆。提供0.6B/4B/8B三种版本,支持119种语言,在多个数据集达先进性能,赋能多种应用场景。
NVIDIA 入局量子基础设施:Ising 模型主打自动校准与实时纠错
NVIDIA宣布推出开源NVIDIA Ising模型,解决量子处理器校准和纠错问题。它含校准和解码两组件,速度和准确性优,可本地部署。与传统方法不同,它是与硬件无关的开源模型层,社区反馈有期待也有疑问。
在 RDS PostgreSQL 中实现 RaBitQ 量化
本文介绍在阿里云 RDS PostgreSQL 上,pgvector 能力进一步增强,引入 RaBitQ 量化提升其在大规模向量场景下的表现。分析了 pgvector 面临的挑战,阐述 RaBitQ 原理、优势,给出性能测试结果及快速上手的 SQL 操作。
AI 成为主流负载后,数据基础设施将如何演进?
随着AI应用爆发式增长,数据系统成为智能系统一部分。Apache Doris社区提出2026年主题‘Scale Intelligence, Accelerate Insight’,从场景和能力两方面阐述演进方向,以响应AI时代数据基础设施变化。
14.5K!冲上Github Trending榜,字节最新开源Agent上下文"数据库"!
OpenViking是字节跳动火山引擎开源的AI Agent上下文数据库。它用文件系统范式管理上下文,有分层加载、递归检索、可视化轨迹和自动会话管理等特性,支持多种模型,测试效果显著。
谷歌Gemini杀入全球桶,血洗微软Office!颠覆全球3亿打工人
谷歌官宣Gemini全面升级版Workspace体验,全线接入Docs、Sheets、Slides。在SpreadsheetBench测试中成绩出色,谷歌Workspace更个性化实用。新功能覆盖文档、表格、幻灯片及云盘,还明确数据边界,欲定义下一代办公软件。
英伟达放弃GPU上LPU:新推理芯片被曝Groq即买即用,OpenAI第一个吃螃蟹
英伟达将在GTC大会发布新AI推理系统,核心芯片基于Groq的LPU架构,首位大客户是OpenAI。选择外部架构与时间窗口有关,推理场景中LPU更适配。同时,英伟达推理芯片面临诸多威胁。