
mac-ocr
用苹果自带识别,把图片和扫描 PDF 一键变成可搜索文本
mac-ocr 是一个基于苹果 Vision 框架的 macOS 命令行工具,用 Swift 编写,用于对图片和 PDF 做文字识别,并生成可搜索的 PDF。它解决的是在 macOS 上批量提取图片文字、把扫描件变成可检索文档的需求,无需联网、不依赖第三方 OCR 服务,直接调用系统内置的 Vision 识别能力,识别速度和隐私性都更好。核心能力包括:对单张或多张图片执行 OCR 输出纯文本;对 PDF 逐页识别并生成带文字层的可搜索 PDF;支持通过命令行参数指定语言、输出路径等。项目还提供 Node.js 调用方式,方便在脚本或自动化流程中集成。适合开发者、运维和需要处理大量扫描文档的用户,在本地快速完成文字提取与 PDF 检索化,避免手动复制或依赖云端服务。
开源
free
计算机视觉
GitHub 星标
★ 511
维护状态
较活跃
是否开源
是
定价模式
free
项目数据
分类计算机视觉
开发团队privatenumber
所属国家
定价模式free
价格说明开源免费,需自行部署
访问状态
是否开源是
开源协议MIT
主要语言Swift
技术栈/模型apple-vision,cli,command-line-tool,image-to-text,macos,nodejs,ocr,pdf,searchable-pdf,swift,text-recognition,vision-framework
GitHub 星标★ 511
30天Star增速
HF 下载量
上线时间2026-06-13 00:00:00
最近更新2026-09-18 00:00:00
维护状态较活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-19
浏览次数0
使用教程
核心亮点
- 直接调用 macOS 内置 Vision 框架,离线可用,不上传图片,隐私性好
- 同时支持图片 OCR 和 PDF 可搜索化,覆盖常见文档处理需求
- 提供 Swift CLI 与 Node.js 两种调用方式,便于集成到自动化脚本
不足之处
- 仅支持 macOS,无法在 Linux 或 Windows 上运行
- 依赖系统 Vision 框架的识别能力,对复杂排版或低质量图片效果有限
适用场景
- 把手机拍摄的纸质文档批量转成可复制、可搜索的文本
- 将扫描版 PDF 加上文字层,方便全文检索和复制引用
- 在自动化脚本或 Node.js 项目中集成图片文字提取步骤
替代项目
tesseract-ocr、ocrmypdf
项目介绍
同类项目推荐
modlens
开源
给纯文本编码代理装上眼睛,粘贴图片即刻获得结构化视觉证据。
The first vision plugin for DeepSeek Harness, and the vision bridge for every text-o···
opencv
开源
开箱即用的视觉算法库,搞定图像视频处理与识别
Open Source Computer Vision Library
OpenCVTutorials
开源
中文 OpenCV 教程,从入门到实战,边看边跑代码
OpenCV-Python4.1 中文文档
DEIMv2
开源
用DINOv3做实时检测,又快又准,直接落地。
[DEIMv2] Real Time Object Detection Meets DINOv3