mac-ocr

用苹果自带识别,把图片和扫描 PDF 一键变成可搜索文本

mac-ocr 是一个基于苹果 Vision 框架的 macOS 命令行工具,用 Swift 编写,用于对图片和 PDF 做文字识别,并生成可搜索的 PDF。它解决的是在 macOS 上批量提取图片文字、把扫描件变成可检索文档的需求,无需联网、不依赖第三方 OCR 服务,直接调用系统内置的 Vision 识别能力,识别速度和隐私性都更好。核心能力包括:对单张或多张图片执行 OCR 输出纯文本;对 PDF 逐页识别并生成带文字层的可搜索 PDF;支持通过命令行参数指定语言、输出路径等。项目还提供 Node.js 调用方式,方便在脚本或自动化流程中集成。适合开发者、运维和需要处理大量扫描文档的用户,在本地快速完成文字提取与 PDF 检索化,避免手动复制或依赖云端服务。

开源 free 计算机视觉
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 511
维护状态 较活跃
是否开源
定价模式 free

项目数据

分类计算机视觉
开发团队privatenumber
所属国家
官网地址
定价模式free
价格说明开源免费,需自行部署
访问状态
是否开源
开源协议MIT
主要语言Swift
技术栈/模型apple-vision,cli,command-line-tool,image-to-text,macos,nodejs,ocr,pdf,searchable-pdf,swift,text-recognition,vision-framework
GitHub 星标★ 511
30天Star增速
HF 下载量
上线时间2026-06-13 00:00:00
最近更新2026-09-18 00:00:00
维护状态较活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-19
浏览次数0

使用教程

核心亮点

  • 直接调用 macOS 内置 Vision 框架,离线可用,不上传图片,隐私性好
  • 同时支持图片 OCR 和 PDF 可搜索化,覆盖常见文档处理需求
  • 提供 Swift CLI 与 Node.js 两种调用方式,便于集成到自动化脚本

不足之处

  • 仅支持 macOS,无法在 Linux 或 Windows 上运行
  • 依赖系统 Vision 框架的识别能力,对复杂排版或低质量图片效果有限

适用场景

  • 把手机拍摄的纸质文档批量转成可复制、可搜索的文本
  • 将扫描版 PDF 加上文字层,方便全文检索和复制引用
  • 在自动化脚本或 Node.js 项目中集成图片文字提取步骤

替代项目

tesseract-ocr、ocrmypdf

项目介绍

mac-ocr 是一个计算机视觉领域的开源项目,官方简介:macOS CLI for OCR and searchable PDFs using Apple's Vision framework。项目使用 Swift 开发,在 GitHub 上获得 511 星标。

上一篇:normcap

下一篇:core

同类项目推荐

modlens 开源

给纯文本编码代理装上眼睛,粘贴图片即刻获得结构化视觉证据。

The first vision plugin for DeepSeek Harness, and the vision bridge for every text-o···

★ 3973 2026-08-19
opencv 开源

开箱即用的视觉算法库,搞定图像视频处理与识别

Open Source Computer Vision Library

★ 90860 2026-08-10
OpenCVTutorials 开源

中文 OpenCV 教程,从入门到实战,边看边跑代码

OpenCV-Python4.1 中文文档

★ 1430 2026-08-20
DEIMv2 开源

用DINOv3做实时检测,又快又准,直接落地。

[DEIMv2] Real Time Object Detection Meets DINOv3

★ 2032 2026-08-14