
normcap
框选屏幕任意区域,文字秒进剪贴板
NormCap 是一款基于 OCR 的屏幕截图工具,核心理念是“捕获信息而非图像”。用户用快捷键框选屏幕任意区域,它立即调用 Tesseract 等 OCR 引擎识别其中的文字,并把结果直接放入剪贴板,省去手动输入或再打开截图软件识别的步骤。它解决的是从图片、PDF、视频、网页等不可复制内容中提取文字的痛点,尤其适合无法选中文本的场景。核心能力包括:跨平台支持 Windows、macOS、Linux;可自定义快捷键与识别语言;支持多种 OCR 引擎;识别结果可自动复制、编辑或保存;界面轻量,常驻托盘,随用随取。项目用 Python 编写,安装简单,适合开发者、翻译、学生和办公人群快速获取屏幕文字。
项目数据
使用教程
环境要求
- Windows 10/11、macOS 或 Linux 桌面环境
- Ubuntu/Debian 需 build-essential、tesseract-ocr、tesseract-ocr-eng、libtesseract-dev
- macOS 需先安装 Homebrew,以及 tesseract、tesseract-lang
- Python 环境(pip 安装方式),或使用 uv 管理虚拟环境
安装与启动步骤
-
1选择安装方式
按系统选一种预构建发布:Windows 用 msi/zip,Linux 用 Flathub,或各平台使用 pip 安装。
-
2安装 Linux 依赖
Ubuntu/Debian 用户先装编译与 OCR 依赖,含 Tesseract 引擎及 Wayland 剪贴板工具。
sudo apt install build-essential tesseract-ocr tesseract-ocr-eng libtesseract-dev libleptonica-dev wl-clipboard -
3通过 Flatpak 安装
Linux 推荐从 Flathub 安装,需先添加 Flathub 远程仓库再安装应用。
flatpak remote-add --if-not-exists flathub https://flathub.org/repo/flathub.flatpakrepo flatpak install flathub com.github.dynobo.normcap -
4macOS 安装依赖
用 Homebrew 安装 Tesseract 及语言包,随后用 pip 安装 NormCap。
brew install tesseract tesseract-lang -
5pip 安装 NormCap
在已配置好 Python 的环境中通过 pip 安装 normcap 包,适用于各平台。
pip install normcap -
6启动运行
安装完成后运行 normcap 命令启动,Windows 可用 normcap,Linux/macOS 可用 ./normcap。
normcap -
7源码方式运行
开发者可创建虚拟环境并同步依赖,再用 uv 运行模块启动。
uv sync uv run python -m normcap
如何确认成功
运行后出现托盘图标,按快捷键框选屏幕区域即可看到识别文字进入剪贴板。
常见问题
Q:安装或运行时遇到问题怎么办?
A:先查看官方 FAQ 页面,仍无法解决可在 GitHub 仓库的 Issues 中搜索或提交问题。
Q:Linux 下 OCR 无法识别文字?
A:确认已安装 tesseract-ocr 及对应语言包(如 tesseract-ocr-eng),缺少引擎时无法识别。
Q:Wayland 下剪贴板不生效?
A:需安装 wl-clipboard 包,README 中多个 Linux 发行版安装命令均包含它。
Q:有几种安装方式可选?
A:README 提示只需选择其中一种:Windows 安装包、Linux Flathub、各平台 pip 或源码 uv 方式。
注意事项
- README 强调只需从预构建发布中选择一种安装方式,不要重复安装。
- Windows 提供 msi 安装版和 zip 便携版两种选择。
- pip 安装前需确保系统已安装 Tesseract 等 OCR 依赖。
- 源码运行需使用 uv 工具同步依赖。
核心亮点
- 框选即识别,结果自动进剪贴板,操作路径极短
- 跨平台支持 Windows、macOS、Linux,且可自定义快捷键
- 支持多语言 OCR 与多种识别引擎,可离线使用
不足之处
- 依赖 Tesseract 等外部 OCR 引擎,首次安装配置略繁琐
- 识别准确率受截图质量与语言模型影响,复杂排版可能出错
适用场景
- 从视频或在线课程画面中提取字幕文字
- 从 PDF 或图片中复制无法选中的段落
- 快速识别游戏、软件界面中的外文并翻译
替代项目
TextShot、gImageReader
项目介绍
上一篇:SimdPaddleOCR
下一篇:mac-ocr
同类项目推荐
modlens
开源
给纯文本编码代理装上眼睛,粘贴图片即刻获得结构化视觉证据。
The first vision plugin for DeepSeek Harness, and the vision bridge for every text-o···
opencv
开源
开箱即用的视觉算法库,搞定图像视频处理与识别
Open Source Computer Vision Library
OpenCVTutorials
开源
中文 OpenCV 教程,从入门到实战,边看边跑代码
OpenCV-Python4.1 中文文档
DEIMv2
开源
用DINOv3做实时检测,又快又准,直接落地。
[DEIMv2] Real Time Object Detection Meets DINOv3