pdf-craft

把扫描版PDF变成可编辑文本,读书笔记一键搞定

pdf-craft 是一个专注于将扫描版 PDF 书籍转换为其他格式的开源工具。它利用 deepseek-ocr 等 OCR 技术,解决扫描 PDF 中文字无法复制、搜索和编辑的痛点。核心能力包括:高精度 OCR 识别、版面分析、文本提取与结构化输出,支持将 PDF 转换为可编辑的文本、Markdown 等格式。项目旨在为数字化阅读、知识管理和文档处理提供自动化流水线,尤其适合处理大量扫描书籍的场景。

开源 unknown 计算机视觉
GitHub 星标 ★ 6128
维护状态 活跃
是否开源
定价模式 unknown

项目数据

分类计算机视觉
开发团队oomol-lab
所属国家
定价模式unknown
价格说明定价信息待确认
访问状态
是否开源
开源协议MIT
主要语言Python
技术栈/模型deepseek-ocr,document,ocr,pdf
GitHub 星标★ 6128
30天Star增速
HF 下载量
上线时间2025-02-12 00:00:00
最近更新2026-08-13 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-14
浏览次数0

核心亮点

  • 基于 deepseek-ocr,识别精度高,尤其对中文扫描件效果好
  • 专攻扫描书籍场景,处理流程针对性强,而非通用 PDF 工具
  • Python 实现,易于集成到自动化工作流中

不足之处

  • 依赖外部 OCR 服务或模型,可能需网络或算力资源
  • 文档/社区待观察

适用场景

  • 将扫描版 PDF 书籍转换为可搜索的电子文档
  • 批量提取 PDF 中的文字用于知识库构建
  • 辅助制作读书笔记或引用文献内容

替代项目

PaddleOCR、Tesseract OCR、pdf2text

项目介绍

pdf-craft 是一个计算机视觉领域的开源项目,官方简介:PDF craft can convert PDF files into various other formats. This project will focus on processing PDF files of scanned books.。项目使用 Python 开发,在 GitHub 上获得 6128 星标。

上一篇:Lifelong-nnUNet

下一篇:DEIMv2

同类项目推荐

opencv 开源

开箱即用的视觉算法库,搞定图像视频处理与识别

Open Source Computer Vision Library

★ 90413 2026-08-10
Awesome-Try-On-Models 开源

一站式找到虚拟试穿最新论文和代码,快速上手。

A repository for organizing papers, codes and other resources related to Virtual Try···

★ 442 2026-08-09
MuscleMap 开源

一键量化全身肌肉 MRI,让科研分析标准化。

MuscleMap: An Open-Source, Community-Supported Consortium for Whole-Body Quantitativ···

★ 116 2026-08-10
geti 开源

少数据快训练,轻松搞定计算机视觉模型

Build computer vision models in a fraction of the time and with less data.

★ 1284 2026-08-10