「手写文档识别」共找到 577 篇相关文章
刚刚,美国把天眼交给Palantir!绝密信件曝光: AI拿到美军正式编制
3月外媒报道,美国国防部副部长信件称,Palantir的Maven人工智能系统将被列为「项目编制」,监管将转移,未来合同由陆军负责。其武器目标识别技术将获长期应用,Maven能整合数据、识别目标,还与Claude助力美军打击伊朗目标。
3.9K Star!Inkeep 把 AI 原生 Markdown 编辑器做成了开源项目!
Inkeep 团队开源 OpenKnowledge,这是真正为 AI 设计的知识库工具,已获 3.9K Star。它有所见即所得、AI 协作等亮点,还基于 Git 同步,保障数据安全,值得 Markdown 工具使用者关注。
像原始人一样和AI对话,费用可直接砍掉40%
开源项目‘caveman-compression’能帮使用ChatGPT API或其他大模型的用户省钱。原理是删废话留关键信息,有调用OpenAI和本地NLP两种压缩方式,不同场景省钱效果不同,还介绍了使用方法。
Hermes Agent 终于有入门指南了
Hermes Agent 是 Nous Research 推出的开源 Agent 框架,功能强大但开发者不知如何使用。4 月 8 号,Kevin Simback 整理出 Hermes 生态全景图,另一人推出《Hermes Agent: The Complete Guide》,48 小时获 568 星。
科研写作神器,超越Mathpix的科学公式提取工具已开源
LaTeX公式OCR现有方法处理真实文献面临挑战,DocTron团队提出系统性方案。构建CSFormula数据集,提出DocTron - Formula模型,在评测和实际应用中表现出色,超越Mathpix等工具。
夯,开源 LiteParse,没有对手的 PDF 解析工具,知道的太晚了!
LlamaIndex团队开源独立工具LiteParse,用Rust打造,可本地运行、零成本、高精度解析PDF。它能提取文本及精确位置,有多种输出格式,支持多格式输入,还介绍了安装、使用、OCR配置等内容及应用场景。
终于敢把真实地址、银行卡、种子词直接扔给大模型了
作者将真实个人信息扔给多个大模型测试,结果模型收到的是脱敏后的占位符,OneAIFW 能自动完成敏感信息的占位和还原,本地完成操作,不留日志不上云,还介绍了使用方法和项目地址。
庞若鸣还有苹果论文?改善预训练高质量数据枯竭困境
苹果基础模型原负责人庞若鸣在 Meta 任职期间,其在苹果参与的高价值研究仍不断发表。研究团队针对大模型训练中高质量数据枯竭问题,提出 Synthetic Bootstrapped Pretraining (SBP) 预训练流程,提升模型性能。
OCR 创新技术解析丨AI Insight Talk 直播预告
在数字经济下,传统 OCR 技术面临诸多挑战。12 月 4 日 20 点,AI Insight OCR 专场直播将剖析三项突破性 OCR 技术方案,还会有圆桌对谈。分享嘉宾将介绍 HunyuanOCR、PaddleOCR - VL、MinerU 等模型亮点。
7.3K Star!港大开源神作,集问答、可视化、出题于一身的 AI 超级导师!
香港大学 HKUDS 开源的 DeepTutor 是爆火的个人学习助手,集文档问答、可视化讲解、智能出题、深度研究于一体,解决自学痛点,还给出了快速入手步骤。