kraken

多语言古籍手写文本,一键转成可编辑文字

Kraken 是一个面向多语言与历史文献的开源 OCR 引擎,由 Python 编写,核心目标是解决传统 OCR 在非拉丁文字、古籍排版和手写文本上的识别难题。它支持 ALTO XML、PAGE XML 等标准交换格式,内置布局分析与神经网络识别模型,可处理从行级到整页的文本抽取流程。项目覆盖 100 多种语言和文字系统,尤其适合需要高精度字符分割与转录的研究场景。用户可通过命令行或 Python API 调用,训练自定义识别模型,并与 eScriptorium 等标注平台配合完成端到端数字化工作流。相比通用 OCR,Kraken 更强调对复杂版面、连字、变音符号和历史印刷体的鲁棒性,是数字人文与档案数字化领域常用的工具之一。

开源 free 计算机视觉
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 1070
维护状态 较活跃
是否开源
定价模式 free

项目数据

分类计算机视觉
开发团队mittagessen
所属国家
官网地址http://kraken.re
定价模式free
价格说明开源免费,官网提供文档与安装指引
访问状态
是否开源
开源协议Apache-2.0
主要语言Python
技术栈/模型alto-xml,handwritten-text-recognition,hocr,htr,layout-analysis,neural-networks,ocr,optical-character-recognition,page-xml
GitHub 星标★ 1070
30天Star增速
HF 下载量
上线时间2015-05-19 00:00:00
最近更新2026-09-15 00:00:00
维护状态较活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-19
浏览次数0

使用教程

难度:入门 约 10 分钟 部署方式:命令行工具 3 步

环境要求

  • 操作系统:Linux 或 macOS(x64 与 ARM 均可),README 未提及 Windows 支持
  • Python 解释器版本需在 3.10 至 3.13 之间
  • 安装由 Python 自带的 pip 工具完成,推荐使用虚拟环境或 pipx 以避免污染系统包管理器
  • Linux 上安装 pipx 需要 sudo 权限(README 示例使用 apt)

安装与启动步骤

  1. 1安装 pipx

    在 Debian/Ubuntu 类 Linux 上通过 apt 安装 pipx,这是 README 推荐的隔离安装方式,避免污染发行版包管理器。macOS 用户请参考 pipx 官方方式安装。

    sudo apt install pipx
  2. 2安装 kraken

    用 pipx 一键安装 kraken。若 pipx 默认使用的 Python 解释器版本不在 3.10–3.13 范围内,安装可能失败。

    pipx install kraken
  3. 3确认解释器版本

    检查本机 Python 版本是否落在 3.10 到 3.13 之间;若 pipx 默认解释器不受支持,需让 pipx 使用受支持的解释器后重新安装。

如何确认成功

安装过程无报错,且 kraken 已由 pipx 正确安装到当前环境,即表示部署成功。

常见问题

Q:安装失败并提示解释器版本不受支持怎么办?

A:README 说明这通常是 pipx 默认使用了不受支持的 Python 版本导致。先确认本机存在 3.10–3.13 之一的解释器,再让 pipx 使用该受支持解释器重新执行 pipx install kraken。

Q:kraken 支持 Windows 吗?

A:README 只说明可在 Linux 与 macOS(x64 和 ARM)上运行,并要求 Python 3.10–3.13,未提及 Windows,建议使用 Linux 或 macOS。

Q:不想用 pipx 可以吗?

A:README 指出安装通过 pip 完成,并建议使用虚拟环境以避免污染系统包管理器;pipx 只是官方给出的省事方案,也可在虚拟环境中安装。

Q:从哪里获取识别模型?

A:README 提到项目在 Zenodo 上有公开的模型文件仓库(Public repository of model files),可从该仓库获取识别模型。

注意事项

  • README 强调尽量使用虚拟环境或 pipx,不要直接污染发行版包管理器。
  • Linux 上安装 pipx 的命令基于 apt(Debian/Ubuntu 系),其他发行版需换用对应的包管理器。
  • kraken 支持 Python 3.10–3.13,解释器版本不符是安装失败的常见原因。
  • 本教程只依据 README 的安装说明整理,README 未给出的命令行参数、端口与路径均未编造。

核心亮点

  • 支持 100+ 语言与文字系统,覆盖非拉丁文与历史字体
  • 内置布局分析与行分割,可直接处理整页扫描图
  • 兼容 ALTO/PAGE XML 标准,方便与数字人文工具链对接

不足之处

  • 安装依赖较重,对 GPU 环境有一定要求
  • 预训练模型覆盖不均,小语种仍需自行训练

适用场景

  • 图书馆古籍与手稿的批量数字化转录
  • 数字人文研究中多语言历史文献的文本挖掘
  • 档案机构将扫描件转为 ALTO/PAGE XML 结构化数据

替代项目

Tesseract、OCRmyPDF、PaddleOCR

项目介绍

kraken 是一个计算机视觉领域的开源项目,官方简介:OCR engine for all the languages。项目使用 Python 开发,在 GitHub 上获得 1070 星标。

上一篇:OCR4all

下一篇:production-ocr-course

同类项目推荐

modlens 开源

给纯文本编码代理装上眼睛,粘贴图片即刻获得结构化视觉证据。

The first vision plugin for DeepSeek Harness, and the vision bridge for every text-o···

★ 3973 2026-08-19
opencv 开源

开箱即用的视觉算法库,搞定图像视频处理与识别

Open Source Computer Vision Library

★ 90860 2026-08-10
OpenCVTutorials 开源

中文 OpenCV 教程,从入门到实战,边看边跑代码

OpenCV-Python4.1 中文文档

★ 1430 2026-08-20
DEIMv2 开源

用DINOv3做实时检测,又快又准,直接落地。

[DEIMv2] Real Time Object Detection Meets DINOv3

★ 2032 2026-08-14