
macOCR
框选屏幕任意文字,秒进剪贴板
macOCR 是一款 macOS 菜单栏工具,解决屏幕上文字无法直接复制的问题。按下全局快捷键框选屏幕任意区域,它就能用系统自带的 Vision 框架做本地 OCR,把识别出的文字直接送进剪贴板,无需联网、无需登录。核心能力包括:全局热键触发、拖拽框选、多语言识别(跟随系统语言)、识别结果自动复制,并支持从剪贴板或图片文件直接识别。整个流程在本地完成,不上传截图,隐私友好,适合处理截图、PDF 预览、视频字幕、报错信息等无法选中的文字。相比截图后手动打字的方案,它把操作压缩到一次框选,是轻量级效率补充工具。
项目数据
使用教程
环境要求
- macOS 系统(基于 Apple Vision 框架,仅支持 Mac)
- 已安装 Homebrew(推荐的安装方式)
- 首次运行需授予屏幕录制权限
安装与启动步骤
-
1安装 macOCR
用 Homebrew 一条命令安装,README 推荐此方式,无需手动下载编译。
brew install schappim/ocr/ocr -
2首次运行并授权
光标会变成十字准星。首次运行会弹出屏幕录制权限请求,授权后需再运行一次 ocr。
ocr -
3框选屏幕取字
拖动鼠标框选任意区域,识别文字会打印到终端并自动复制到剪贴板;按 Esc 取消且不动剪贴板。
ocr -
4识别剪贴板图片
不改动屏幕截图流程,直接读取你刚复制到剪贴板的那张图片里的文字。
ocr -c -
5识别图片或 PDF 文件
不截屏,直接读取本地图片;PDF 会逐页读取识别,适合不可复制的文档。
ocr -i ~/Desktop/receipt.png ocr -i scan.pdf -
6指定识别语言
默认按英语识别,其它语言需用 -l 指定,例如日语用 ja-JP。
ocr -l ja-JP -
7固定区域与结构化输出
用 --rect 跳过拖拽固定捕获坐标;--json 输出结构化结果便于脚本调用。
ocr --rect 0,0,800,600 ocr --json
关键配置
| 配置项 | 必填 | 说明 | 示例 |
|---|---|---|---|
-l | 否 | 指定识别语言,默认英语 | ja-JP |
-i | 否 | 识别本地图片或 PDF 文件,不走截屏 | ~/Desktop/receipt.png |
-c | 否 | 识别剪贴板中已有的图片 | -c |
--rect | 否 | 捕获固定区域,无需拖拽框选 | 0,0,800,600 |
-b | 否 | 只识别二维码和条形码,忽略正文 | -b |
--json | 否 | 输出结构化 JSON,方便脚本处理 | --json |
如何确认成功
运行 ocr 后光标变十字准星,框选后文字同时打印到终端并出现在剪贴板中可直接粘贴。
常见问题
Q:首次运行没有反应或没取到字?
A:macOCR 需要屏幕录制权限。请在系统设置中授予权限,然后重新运行 ocr。
Q:按 Esc 取消会把内容复制到剪贴板吗?
A:不会。取消后不复制任何内容,剪贴板保持原样。
Q:能否识别二维码和条形码?
A:可以。默认会同时读取区域内的文字与二维码/条码内容,用 -b 则只读码。
Q:为什么识别出的语言不对?
A:默认按英语识别,需用 -l 指定语言,例如日语加 ocr -l ja-JP。
Q:从 Alfred、Raycast 或快捷指令调用时没弹权限?
A:权限提示属于调用它的那个应用而非终端,需要在对应应用上批准屏幕录制权限。
注意事项
- 全部处理在本地用 Apple Vision 完成,不上传截图、不需要 API Key、可离线使用。
- 从其它 App(Alfred、Raycast、Shortcuts)调用时,权限归属于那个 App,要单独授权。
- 除截屏外,还支持读取剪贴板图片以及逐页读取 PDF。
核心亮点
- 全局快捷键+框选,操作路径极短,识别完自动复制
- 基于系统 Vision 框架,完全本地运行,不联网不上传截图
- 原生 Swift 开发,体积小、启动快,菜单栏常驻不占 Dock
不足之处
- 仅支持 macOS,且需要较新系统版本才能使用 Vision 文字识别
- 识别语言依赖系统设置,缺少手动切换语言和批量图片处理等进阶功能
适用场景
- 从视频、直播或在线课程画面里提取字幕文字
- 复制 PDF 预览、图片或报错弹窗中无法选中的文字
- 快速摘录会议截图、聊天截图里的关键信息
替代项目
TextSniper、tesseract.js、NormCap
项目介绍
上一篇:HunyuanOCR
下一篇:tessdoc
同类项目推荐
modlens
开源
给纯文本编码代理装上眼睛,粘贴图片即刻获得结构化视觉证据。
The first vision plugin for DeepSeek Harness, and the vision bridge for every text-o···
opencv
开源
开箱即用的视觉算法库,搞定图像视频处理与识别
Open Source Computer Vision Library
OpenCVTutorials
开源
中文 OpenCV 教程,从入门到实战,边看边跑代码
OpenCV-Python4.1 中文文档
DEIMv2
开源
用DINOv3做实时检测,又快又准,直接落地。
[DEIMv2] Real Time Object Detection Meets DINOv3