「检索器」共找到 489 篇相关文章
Vercel 开源 Bash 工具:基于本地文件系统的上下文检索
Vercel开源bash - tool,为AI智能体提供Bash执行引擎,让其通过shell命令在文件夹操作获取上下文,有三大核心操作,部署灵活,可节省token,贴合Unix工作流,或影响未来AI开发系统处理本地上下文方式。
阿里搞了个全能解析器,文档、图片、音频、视频一锅端
阿里巴巴开源 Logics-Parsing-Omni,用一个模型统一处理文档、图片、音频、视频四种模态,输出结构化 JSON 数据。它采用三级渐进解析框架,两阶段训练策略,在自建基准上多项指标超越 Gemini - 3 - Pro。
蚂蚁C2LLM:基于注意力池化的代码检索新范式
在Code RAG场景中,传统文本Embedding模型处理代码表现欠佳。蚂蚁集团与上海交通大学联合发布C2LLM系列模型,引入注意池化模块,在MTEB - Code榜单表现出色,还得益于优质训练流程,成果已回馈社区。
吴恩达发布论文自动审阅器,ICLR上达到接近人类水平
目前学术会议论文评审无统一规范,投稿量膨胀致审稿周期冗长。吴恩达发布‘Agentic Reviewer’,在ICLR 2025数据测试中接近人类水平,现阶段在arXiv研究领域表现佳,但仍处实验阶段。
告别「解码器饥饿」!中国科学院NeurIPS推SpaceServe,高并发克星
中国科学院计算技术研究所入选NeurIPS 2025的论文提出SpaceServe架构,将LLM推理P/D分离扩展至多模态场景,通过EPD三阶解耦与「空分复用」,解决MLLM推理行头阻塞难题,在Qwen2 - VL系列模型实测中表现出色。
答对了却没看图?EASE给多模态RLVR装上「视线校正器」
强化学习与可验证奖励提升视觉语言模型推理能力,但存在答案奖励只知对错、不知证据区域问题。哈工大等团队提出EASE,把标注证据区转为目标分布,监督空间注意力,推理无额外标注,实验成绩优异。
释放创造力:解密 AI 贴纸生成器的“神级”提示词模板
文章介绍日本网友分享的 Gem 应用,可上传照片生成各种风格贴纸。详细阐述提示词模板概念、规律特点,还给出波普艺术、日式复古火柴盒等多种贴纸风格提示词库及可用情绪列表,最后鼓励读者动手尝试。
Jina 第4版:多模态向量检索,统一适配,挑战3大任务
Jina第4版基于Qwen2.5 - VL模型扩展,支持单向量和多向量输出。它经对比学习和任务特化训练,推理时可按需选LoRA适配器,能利用多模态处理能力优化不同任务性能。
14.9k Star!Firecrawl 开源的 PDF 智能分类器,200 份文档 0.47 秒搞定!
Firecrawl 开源 PDF 智能分类与文本提取库 pdf-inspector,已获超 1.4 万人标星。它能智能分类、感知提取、转 Markdown 及按需路由,性能炸裂,分类快,多项指标领先,还支持多平台。
探索 GPU 加速向量检索:NVDIA Cagra 在微信大规模推荐系统中的应用实践
本文分享腾讯团队将 Cagra GPU 图索引大规模应用于微信核心线上推荐业务的实践。介绍 Cagra 算法原理与优势,讲述线上化改造、架构演进、CPU/GPU 协同优化等,展示业务落地显著收益。