core

把零散 OCR 工具串成标准化流水线,古籍数字化更省心

OCR-D 的 core 是面向历史文献与古籍数字化场景的 Python 工具集与封装库,属于 OCR-D 生态的核心组件。它解决的问题是:传统 OCR 工具(如 Tesseract、OCRopus)各自为政,缺少统一的数据格式、处理流程与接口标准,导致大规模文献数字化项目难以组合、替换和复用不同厂商的 OCR 模块。core 提供了标准化的处理器接口、页面/区域/行级的数据模型、工作流编排与命令行工具,让开发者可以把图像预处理、版面分析、文本识别、后处理等步骤串成可复现的流水线。核心能力包括:统一的 OCR-D 数据规范、处理器发现与调用机制、Python API 与 CLI、以及与其他 OCR-D 模块的互操作支持。项目体量较小、偏底层基础设施,适合作为文献 OCR 流水线的骨架使用。

开源 free 计算机视觉
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 136
维护状态 活跃
是否开源
定价模式 free

项目数据

分类计算机视觉
开发团队OCR-D
所属国家
定价模式free
价格说明开源免费工具集
访问状态
是否开源
开源协议Apache-2.0
主要语言Python
技术栈/模型ocr-d
GitHub 星标★ 136
30天Star增速
HF 下载量
上线时间2017-11-28 00:00:00
最近更新2026-09-16 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-19
浏览次数0

使用教程

核心亮点

  • 提供统一的 OCR-D 数据模型与处理器接口,便于替换和组合不同 OCR 模块
  • 同时提供 Python API 和命令行工具,方便脚本化与集成到现有流水线
  • 与 OCR-D 生态其他模块互操作,适合大规模历史文献数字化项目

不足之处

  • 项目偏底层基础设施,单独使用无法直接完成 OCR,需搭配其他处理器
  • 星标数较少,社区规模小,中文资料与示例有限

适用场景

  • 图书馆与档案馆的历史文献、古籍批量 OCR 数字化
  • 研究者搭建可复现的 OCR 实验流水线,对比不同识别模块
  • 开发者将 OCR 能力集成到文献管理或数字人文平台

替代项目

tesseract、ocrmypdf

项目介绍

core 是一个计算机视觉领域的开源项目,官方简介:Collection of OCR-related python tools and wrappers from @OCR-D。项目使用 Python 开发,在 GitHub 上获得 136 星标。

上一篇:mac-ocr

下一篇:oar-ocr

同类项目推荐

modlens 开源

给纯文本编码代理装上眼睛,粘贴图片即刻获得结构化视觉证据。

The first vision plugin for DeepSeek Harness, and the vision bridge for every text-o···

★ 3995 2026-08-19
opencv 开源

开箱即用的视觉算法库,搞定图像视频处理与识别

Open Source Computer Vision Library

★ 90893 2026-08-10
OpenCVTutorials 开源

中文 OpenCV 教程,从入门到实战,边看边跑代码

OpenCV-Python4.1 中文文档

★ 1430 2026-08-20
DEIMv2 开源

用DINOv3做实时检测,又快又准,直接落地。

[DEIMv2] Real Time Object Detection Meets DINOv3

★ 2035 2026-08-14