macOCR

框选屏幕任意文字,秒进剪贴板

macOCR 是一款 macOS 菜单栏工具,解决屏幕上文字无法直接复制的问题。按下全局快捷键框选屏幕任意区域,它就能用系统自带的 Vision 框架做本地 OCR,把识别出的文字直接送进剪贴板,无需联网、无需登录。核心能力包括:全局热键触发、拖拽框选、多语言识别(跟随系统语言)、识别结果自动复制,并支持从剪贴板或图片文件直接识别。整个流程在本地完成,不上传截图,隐私友好,适合处理截图、PDF 预览、视频字幕、报错信息等无法选中的文字。相比截图后手动打字的方案,它把操作压缩到一次框选,是轻量级效率补充工具。

开源 free 计算机视觉
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 2436
维护状态 较活跃
是否开源
定价模式 free

项目数据

分类计算机视觉
开发团队schappim
所属国家
官网地址
定价模式free
价格说明开源免费,无付费计划
访问状态
是否开源
开源协议
主要语言Swift
技术栈/模型
GitHub 星标★ 2436
30天Star增速
HF 下载量
上线时间2021-05-19 00:00:00
最近更新2026-09-12 00:00:00
维护状态较活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-19
浏览次数0

使用教程

难度:入门 约 5 分钟 部署方式:命令行工具 7 步

环境要求

  • macOS 系统(基于 Apple Vision 框架,仅支持 Mac)
  • 已安装 Homebrew(推荐的安装方式)
  • 首次运行需授予屏幕录制权限

安装与启动步骤

  1. 1安装 macOCR

    用 Homebrew 一条命令安装,README 推荐此方式,无需手动下载编译。

    brew install schappim/ocr/ocr
  2. 2首次运行并授权

    光标会变成十字准星。首次运行会弹出屏幕录制权限请求,授权后需再运行一次 ocr。

    ocr
  3. 3框选屏幕取字

    拖动鼠标框选任意区域,识别文字会打印到终端并自动复制到剪贴板;按 Esc 取消且不动剪贴板。

    ocr
  4. 4识别剪贴板图片

    不改动屏幕截图流程,直接读取你刚复制到剪贴板的那张图片里的文字。

    ocr -c
  5. 5识别图片或 PDF 文件

    不截屏,直接读取本地图片;PDF 会逐页读取识别,适合不可复制的文档。

    ocr -i ~/Desktop/receipt.png
    ocr -i scan.pdf
  6. 6指定识别语言

    默认按英语识别,其它语言需用 -l 指定,例如日语用 ja-JP。

    ocr -l ja-JP
  7. 7固定区域与结构化输出

    用 --rect 跳过拖拽固定捕获坐标;--json 输出结构化结果便于脚本调用。

    ocr --rect 0,0,800,600
    ocr --json

关键配置

配置项必填说明示例
-l指定识别语言,默认英语ja-JP
-i识别本地图片或 PDF 文件,不走截屏~/Desktop/receipt.png
-c识别剪贴板中已有的图片-c
--rect捕获固定区域,无需拖拽框选0,0,800,600
-b只识别二维码和条形码,忽略正文-b
--json输出结构化 JSON,方便脚本处理--json

如何确认成功

运行 ocr 后光标变十字准星,框选后文字同时打印到终端并出现在剪贴板中可直接粘贴。

常见问题

Q:首次运行没有反应或没取到字?

A:macOCR 需要屏幕录制权限。请在系统设置中授予权限,然后重新运行 ocr。

Q:按 Esc 取消会把内容复制到剪贴板吗?

A:不会。取消后不复制任何内容,剪贴板保持原样。

Q:能否识别二维码和条形码?

A:可以。默认会同时读取区域内的文字与二维码/条码内容,用 -b 则只读码。

Q:为什么识别出的语言不对?

A:默认按英语识别,需用 -l 指定语言,例如日语加 ocr -l ja-JP。

Q:从 Alfred、Raycast 或快捷指令调用时没弹权限?

A:权限提示属于调用它的那个应用而非终端,需要在对应应用上批准屏幕录制权限。

注意事项

  • 全部处理在本地用 Apple Vision 完成,不上传截图、不需要 API Key、可离线使用。
  • 从其它 App(Alfred、Raycast、Shortcuts)调用时,权限归属于那个 App,要单独授权。
  • 除截屏外,还支持读取剪贴板图片以及逐页读取 PDF。

核心亮点

  • 全局快捷键+框选,操作路径极短,识别完自动复制
  • 基于系统 Vision 框架,完全本地运行,不联网不上传截图
  • 原生 Swift 开发,体积小、启动快,菜单栏常驻不占 Dock

不足之处

  • 仅支持 macOS,且需要较新系统版本才能使用 Vision 文字识别
  • 识别语言依赖系统设置,缺少手动切换语言和批量图片处理等进阶功能

适用场景

  • 从视频、直播或在线课程画面里提取字幕文字
  • 复制 PDF 预览、图片或报错弹窗中无法选中的文字
  • 快速摘录会议截图、聊天截图里的关键信息

替代项目

TextSniper、tesseract.js、NormCap

项目介绍

macOCR 是一个计算机视觉领域的开源项目,官方简介:Get any text on your screen into your clipboard.。项目使用 Swift 开发,在 GitHub 上获得 2436 星标。

上一篇:HunyuanOCR

下一篇:tessdoc

同类项目推荐

modlens 开源

给纯文本编码代理装上眼睛,粘贴图片即刻获得结构化视觉证据。

The first vision plugin for DeepSeek Harness, and the vision bridge for every text-o···

★ 3995 2026-08-19
opencv 开源

开箱即用的视觉算法库,搞定图像视频处理与识别

Open Source Computer Vision Library

★ 90893 2026-08-10
OpenCVTutorials 开源

中文 OpenCV 教程,从入门到实战,边看边跑代码

OpenCV-Python4.1 中文文档

★ 1430 2026-08-20
DEIMv2 开源

用DINOv3做实时检测,又快又准,直接落地。

[DEIMv2] Real Time Object Detection Meets DINOv3

★ 2035 2026-08-14