
core
把零散 OCR 工具串成标准化流水线,古籍数字化更省心
OCR-D 的 core 是面向历史文献与古籍数字化场景的 Python 工具集与封装库,属于 OCR-D 生态的核心组件。它解决的问题是:传统 OCR 工具(如 Tesseract、OCRopus)各自为政,缺少统一的数据格式、处理流程与接口标准,导致大规模文献数字化项目难以组合、替换和复用不同厂商的 OCR 模块。core 提供了标准化的处理器接口、页面/区域/行级的数据模型、工作流编排与命令行工具,让开发者可以把图像预处理、版面分析、文本识别、后处理等步骤串成可复现的流水线。核心能力包括:统一的 OCR-D 数据规范、处理器发现与调用机制、Python API 与 CLI、以及与其他 OCR-D 模块的互操作支持。项目体量较小、偏底层基础设施,适合作为文献 OCR 流水线的骨架使用。
开源
free
计算机视觉
GitHub 星标
★ 136
维护状态
活跃
是否开源
是
定价模式
free
项目数据
分类计算机视觉
开发团队OCR-D
所属国家
定价模式free
价格说明开源免费工具集
访问状态
是否开源是
开源协议Apache-2.0
主要语言Python
技术栈/模型ocr-d
GitHub 星标★ 136
30天Star增速
HF 下载量
上线时间2017-11-28 00:00:00
最近更新2026-09-16 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-19
浏览次数0
使用教程
核心亮点
- 提供统一的 OCR-D 数据模型与处理器接口,便于替换和组合不同 OCR 模块
- 同时提供 Python API 和命令行工具,方便脚本化与集成到现有流水线
- 与 OCR-D 生态其他模块互操作,适合大规模历史文献数字化项目
不足之处
- 项目偏底层基础设施,单独使用无法直接完成 OCR,需搭配其他处理器
- 星标数较少,社区规模小,中文资料与示例有限
适用场景
- 图书馆与档案馆的历史文献、古籍批量 OCR 数字化
- 研究者搭建可复现的 OCR 实验流水线,对比不同识别模块
- 开发者将 OCR 能力集成到文献管理或数字人文平台
替代项目
tesseract、ocrmypdf
项目介绍
同类项目推荐
modlens
开源
给纯文本编码代理装上眼睛,粘贴图片即刻获得结构化视觉证据。
The first vision plugin for DeepSeek Harness, and the vision bridge for every text-o···
opencv
开源
开箱即用的视觉算法库,搞定图像视频处理与识别
Open Source Computer Vision Library
OpenCVTutorials
开源
中文 OpenCV 教程,从入门到实战,边看边跑代码
OpenCV-Python4.1 中文文档
DEIMv2
开源
用DINOv3做实时检测,又快又准,直接落地。
[DEIMv2] Real Time Object Detection Meets DINOv3