PDF解析器」共找到 496 篇相关文章

开源动态7

PDF/DOCX/HTML/扫描文档接卸不再愁!D自动解析文档并统一格式的开源库edoc

Dedoc是开放通用系统,能将文档转换为统一格式,提取逻辑结构和内容。用Python实现,支持多种格式,有可扩展性等优势,还能处理扫描文档,可用于多个系统,介绍了安装方法。

GitHubStore
开源动态8

字节跳动开源文档解析大模型Dolphin,告别繁琐的文档处理,上线狂揽1k星,真是绝了!

字节跳动开源文档解析大模型Dolphin,采用两阶段分析 - 解析范式,有异构锚点提示等功能,适用多领域。技术架构基于视觉 - 编码 - 解码,训练集超3000万个样本,安装推理简单,比同类更具竞争力。

小华同学ai
算法论文7

震撼实锤!清华姚班校友揭「1.4×加速」陷阱:AI优化为何名不符实?

为降低大模型预训练成本,近年新优化频出,宣称加速1.4×到2×却难落地。斯坦福研究指出方法学缺陷,对比不同缩放范式加速差异,给出优化设计见解,证实严格基准评测必要。

新智元
开源动态8

GitHub 狂飙 2.5 万标星,这款「会自愈」的 Python 爬虫框架杀疯了!

GitHub上爆火的Scrapling项目,是自适应Web爬虫框架。它能让爬虫‘学习’和‘适应’,解析可自动定位元素,请求能绕过反爬系统,性能强且支持多种会话类型,还能与AI工具集成。

开源星探
开源动态7

可从表复杂文档中提取结构化数据的Python库agentic-doc,支持100+页PDF长文档

LandingAI的Agentic文档提取API可从复杂文档提取结构化数据,Python库agentic-doc封装该API,支持100+页PDF长文档,有自动重试、并行处理等功能,还能可视化调试。

GitHubStore
开源动态7

李飞飞空间智能独角兽开源底层技术!AI生成3D世界在所有设备流畅运行空间智能的“着色”来了

李飞飞创立的World Labs开源核心技术Forge渲染,可在各设备实时、流畅渲染AI生成的3D世界。它是Web端3D高斯泼溅渲染,地位似传统3D领域“着色”,还解决了3DGS渲染难题。

量子位
推荐文章7

【综述】MRAG5项关键技术(一):解析、索引

文章围绕多模态检索增强生成(MRAG)的关键技术展开。介绍多模态文档的三种类型,阐述文档解析与索引的方法,包括基于提取和基于表示的方法,还指出基于提取方法存在的局限性。

CourseAI
算法论文8

AgentAuditor: 让智能体安全评估的精确度达到人类水平

LLM智能体进化为“行动派”,但自主权带来安全问题。现有评估基准缺乏有效精准评估,研究者推出AgentAuditor框架及ASSEBench基准,让LLM评估精确度达人类水平,为构建可靠智能体提供工具。

机器之心
算法论文8

无需验证的RL:RLPR解锁LLM通用推理潜能

现有依赖强化学习与可验证奖励(RLVR)提升大语言模型(LLM)推理能力的方法,受限于领域特定验证。本文提出RLPR框架,利用LLM生成正确答案的固有概率作奖励信号,实现无需外部验证的通用领域强化学习,效果显著。

深度学习自然语言处理
算法论文8

ICLR 2026 Oral | Revela:用语言建模重新定义稠密检索训练

在检索增强生成系统中,稠密检索是核心组件,但传统训练方法有局限。德国达姆施塔特工业大学蔡丰宇团队提出Revela,将检索训练目标统一到语言建模框架,优势明显,实验效果佳。

机器之心