「RAG性能优化」共找到 2982 篇相关文章
图像、视频一模搞定!字节全能原生多模态本地可部署
字节开源原生多模态模型Lance,仅3B激活参数,40G显存就能跑,已登顶huggingface趋势榜。它能进行图像与视频的理解、生成、编辑等操作,在多个基准测试中表现优异,多项性能居首。
Tokenization谢幕?H-Net登场:Mamba作者新作正面硬刚Transformer
「Mamba」作者之一Albert Gu在新Paper提出新技术,实现动态分块机制,嵌入H - Net可替代传统流水线。在多方面实验中,H - Net性能优于基于BPE token的Transformer模型。
支持5000+ Server,ScaleMCP为大模型Agents动态同步MCP工具
现有工具选择框架未整合MCP服务器,存在重复、不一致和低效问题。普华永道提出ScaleMCP,配备MCP工具检索器,还提出TDWA嵌入策略,通过实验证明其提升了LLM代理性能。
包含一个 75+ AI 工程项目!所有内容100%开源
此 GitHub 仓库含 93+ 生产级 AI 项目,覆盖大语言模型、RAG、Agent 等主题。有不同难度项目及教程,适合各水平人士,还给出新手入门学习路径,采用 MIT 许可。
华为开源7B多模态模型,视觉定位和OCR能力出色,你的昇腾端侧“新甜点”来了
华为推出开源多模态模型openPangu-VL-7B,适配昇腾端侧。它推理性能性价比高,在多核心任务表现突出,技术报告还披露核心技术细节,为昇腾使用者带来新选择,丰富昇腾生态。
终于,NotebookLM 和 Gemini 合体了。这是什么神之更新?
NotebookLM社交账号更新,现用户可将其笔记本上传到Gemini App,Pro会员在Gemini Web版能用此功能。二者合体类似Agentic RAG,但目前整合欠佳,未来体验有望提升。
狂涨91.4K star!!号称是下一代Vim编辑器,体验超棒!
本文介绍开源项目Neovim,它是Vim分支,扩展性强、好用,内置终端模拟器,支持图形界面,与Vim插件兼容性好,还介绍其性能特色、安装配置方法及常用命令。
本地部署Qwen 3.8 27B,要用什么配置
Qwen 3.8 27B是性能好、体积小的开源模型,个人也能本地部署。本地跑开源大模型,重点看容量和带宽两个指标,还介绍了Mac、RTX 5090、RTX PRO 6000三种部署方案及优缺点。
以「图」破局,HyperOffload定义超节点存储管理新范式
随着生成式AI进入万亿参数时代,大语言模型面临“显存墙”挑战。上海交大与华为MindSpore团队发布技术报告《HyperOffload》,其核心技术集成于MindSpore 2.8,能提升超节点异构资源协同效率,已在多项目落地。
14.9k Star!Firecrawl 开源的 PDF 智能分类器,200 份文档 0.47 秒搞定!
Firecrawl 开源 PDF 智能分类与文本提取库 pdf-inspector,已获超 1.4 万人标星。它能智能分类、感知提取、转 Markdown 及按需路由,性能炸裂,分类快,多项指标领先,还支持多平台。