结构化长文档检索」共找到 1008 篇相关文章

产品应用7

阿里QwenLong-32B:1W+超长Token推理,知识密集型复杂文档高效推理

文章介绍阿里QwenLong - 32B在长文本推理的能力。长文本推理有训练效率低和优化不稳定问题,QWENLONG - L1通过强化学习等解决,还阐述其组件、训练步骤,并给出实战代码及相关链接。

CourseAI
产品应用8

探索 GPU 加速向量检索:NVDIA Cagra 在微信大规模推荐系统中的应用实践

本文分享腾讯团队将 Cagra GPU 图索引大规模应用于微信核心线上推荐业务的实践。介绍 Cagra 算法原理与优势,讲述线上化改造、架构演进、CPU/GPU 协同优化等,展示业务落地显著收益。

腾讯技术工程
算法论文8

NTU S-Lab 团队探索可动 3D 新方向:结构、关节、纹理一次到位

南洋理工大学 S-Lab 团队发布研究,提出统一建模框架,能从单张图像生成可动三维对象,在几何精度、外观一致性与运动合理性上显著提升,解决了现有方法的难题,为相关领域发展奠定基础。

AI科技评论
算法论文8

IEEE TPAMI 2025 | 北京大学提出分布驱动的终身学习范式,用结构建模解决灾难性遗忘

北京大学周嘉欢与彭宇新教授合作在 IEEE TPAMI 发布研究成果 DKP++,针对终身学习的灾难性遗忘问题,提出分布建模引导的框架,增强历史知识记忆与跨域学习能力,代码已开源。

机器之心
新闻资讯7

OpenAI 的“编程”新范式?其实是瀑布模型的回魂:“听 PM 的话、写需求文档

在AI工程师大会上,OpenAI研究员Sean Grove提出“规范驱动开发”,认为清晰规范将取代代码成软件开发核心。此观点引发讨论,有人认同,有人反对,也代表了AI编程从“造轮子”到“定方向”的转折。

AI前线
新闻资讯8

终于来了!ChatGPT更新:新增录音功能,深度研究也可以访问文档和应用程序了

OpenAI对ChatGPT进行更新,在深度研究功能中增加连接器,可连接企业和个人数据源,进行更深入搜索分析;新增录音模式,支持自动整理重点内容等。还调整定价策略,让现有部分用户能访问新功能。

AI寒武纪
产品应用7

别再错过啦,AI Agent记忆革命:95.2%检索率的持久记忆系统深度解析

agentmemory是为AI编码Agent打造的持久记忆系统,能自动捕获操作上下文,有三层搜索与四层记忆架构。支持12+种主流AI Agent,有全平台覆盖、零外部依赖等优势,虽有局限但值得开发者一试。

小华同学ai
开源动态8

代码检索新王登基!CodeFuse | 开源C2LLM,用“注意力池化”刷新MTEB-Code榜单

蚂蚁集团与上海交通大学推出C2LLM系列模型,基于注意力创新池化机制解决代码表征痛点,登顶MTEB - Code榜单。作为CodeFuse Embedding开源家族成员,将全套回馈社区,为代码大模型研发提供基线。

AINLPer
开源动态7

超强开源OCR,手写体识别能力超dots.ocr,封存多年的老文档数字化有救了。

文章推荐新开源的OCR系统Chandra,它对手写体识别做了优化,官方测评数据显示比dots.ocr强。介绍其适用于多场景及功能特点,还展示了不同场景的识别效果,建议有需求者多对比测试。

开源AI项目落地
产品应用7

RAG性能优化:基于RAGFlow自定义解析工具实现文本结构化(含源码教学)

文章围绕RAG性能优化展开,指出RAGFlow框架中DeepDoc解析算法不足,介绍开源与商业化解析工具优劣势及API调用和本地部署特点,推荐TextIn xParse,给出RAGFlow+TextIn知识库构建方法,还探讨了RAG优化方案。

AINLPer