local-llm-pdf-ocr 是计算机视觉领域的开源项目,由 ahnafnafee 开发,2025 年首次发布。
它收录于计算机视觉分类,该分类目前共有 467 个项目,GitHub 星标数为 120。
项目保持着较活跃的维护节奏,最近一次代码更新于 2026-09-28。开源免费,本地离线运行无需API密钥。
它主要面向的使用场景是:处理含表格、公式的学术论文扫描件,转成可搜索PDF便于检索引用。同类可对比的替代方案包括 OCRmyPDF、PaddleOCR、Tesseract。

本地跑视觉大模型,扫描 PDF 秒变可搜索文本
local-llm-pdf-ocr 是一个把扫描版 PDF 转成可搜索文本的本地工具,核心思路是调用视觉大模型 olmOCR 完成 OCR,全程离线运行,不上传任何文件,也不需要 API Key。它解决的是传统 OCR 对复杂排版、表格、公式识别差,以及云端 OCR 服务收费、隐私风险高的问题。项目同时提供现代 Web UI 和 CLI 两种使用方式,后端基于 FastAPI,支持把识别结果写回 PDF 生成可搜索文档。适合处理合同、论文、发票、书籍等扫描件,尤其适合对数据隐私敏感、不想把文件交给第三方云服务的个人和小团队。安装后只需本地跑起服务,上传 PDF 即可得到带文字层的可搜索版本,免费且可批量处理。
OCRmyPDF、PaddleOCR、Tesseract
local-llm-pdf-ocr 是计算机视觉领域的开源项目,由 ahnafnafee 开发,2025 年首次发布。
它收录于计算机视觉分类,该分类目前共有 467 个项目,GitHub 星标数为 120。
项目保持着较活跃的维护节奏,最近一次代码更新于 2026-09-28。开源免费,本地离线运行无需API密钥。
它主要面向的使用场景是:处理含表格、公式的学术论文扫描件,转成可搜索PDF便于检索引用。同类可对比的替代方案包括 OCRmyPDF、PaddleOCR、Tesseract。
上一篇:laravel-ocr
下一篇:manuscript-ocr
modlens
开源
给纯文本编码代理装上眼睛,粘贴图片即刻获得结构化视觉证据。
The first vision plugin for DeepSeek Harness, and the vision bridge for every text-o···
opencv
开源
开箱即用的视觉算法库,搞定图像视频处理与识别
Open Source Computer Vision Library
DEIMv2
开源
用DINOv3做实时检测,又快又准,直接落地。
[DEIMv2] Real Time Object Detection Meets DINOv3
OpenCVTutorials
开源
中文 OpenCV 教程,从入门到实战,边看边跑代码
OpenCV-Python4.1 中文文档