开源动态7
DeepSeek - OCR:降本增效超越现有模型
CourseAI
AI 摘要
DeepSeek - OCR发布,不单纯提升文字识别能力,而是用光学压缩技术控制大模型token成本。其架构含编码器和解码器,用多样数据集训练,少token就能超越现有模型。
阅读原文 · CourseAI
DeepSeek-OCR降本增效,10×暴力压缩还能读得清
Deepseek - OCR模型发布,通过光学压缩技术解决长文本处理的计算效率问题,能控制大模型token消耗成本。介绍了其架构设计、数据引擎及训练流程,还展示其用较少token超越现有模型的能力。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
产品应用8
DeepSeek V4 Pro上线,性能追平价仅Claude 2%
2026年8月12日,DeepSeek V4 Pro正式版上线。它是混合专家模型,规模居世界第一梯队。价格比Claude Fable 5便宜超98%,成本优势明显。其架构节省成本,API开放多模式,产品结构清晰。
DeepTech深科技
Product Application7
Claude无需越狱就能操作iPhone
LLM操作手机以往方案有局限,phone - harness利用macOS Sequoia的iPhone镜像功能,通过截取镜像窗口、注入操作、截屏验证实现Claude操作iPhone,还介绍安装步骤、踩坑及已知限制。
AI工程化
开源动态8
Firecrawl开源神器,降低PDF解析的OCR成本
处理PDF时,若全用OCR成本和延迟会增加,直接提取文本又易遇乱序、乱码等问题。Firecrawl开源的pdf - inspector工具能智能区分扫描版和文本版PDF,按需使用OCR,精准处理。
开源AI项目落地
开源动态8
codex-vision-proxy让DeepSeek开启看图技能
GitHub上的项目codex-vision-proxy让接进Codex的DeepSeek能看图,不用换模型或等官方,装本地代理即可。它还附带视觉工具包,在智能文档解析和OCR上潜力大,证明多模态能力可长在管道上。
CourseAI