dpscreenocr

框选屏幕任意区域,一键提取文字到剪贴板

dpscreenocr 是一个用 C++ 编写的屏幕文字识别工具,基于 Tesseract OCR 引擎,能够直接截取屏幕区域并识别其中的文字内容。它解决的是用户无法复制屏幕中文字的问题,比如图片、视频字幕、游戏界面、PDF 扫描件或某些禁止复制的软件界面中的文本。核心能力包括屏幕区域选择、实时截图、调用 Tesseract 进行多语言 OCR 识别,并将结果输出到剪贴板或文本文件。项目依赖 Tesseract 和 Leptonica 等库,编译后可在 Windows 平台运行,适合需要快速提取屏幕文字但不想打开大型办公软件的用户。整体定位轻量、专注,适合作为 OCR 工具链中的屏幕捕获前端。

开源 free 计算机视觉
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 296
维护状态 活跃
是否开源 是
定价模式 free

项目数据

分类计算机视觉
开发团队danpla
所属国家
定价模式free
价格说明开源免费软件,基于Tesseract OCR
访问状态
是否开源是
开源协议Zlib
主要语言C++
技术栈/模型ocr,tesseract,tesseract-ocr
GitHub 星标★ 296
30天Star增速
HF 下载量
上线时间2019-03-04 00:00:00
最近更新2026-09-28 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-30
浏览次数0

使用教程

核心亮点

  • 直接框选屏幕区域识别,省去截图再导入的步骤
  • 基于 Tesseract,支持多语言识别且可离线使用
  • C++ 实现体积小、启动快,适合常驻后台快捷调用

不足之处

  • 仅支持 Windows 平台,跨平台能力缺失
  • 依赖 Tesseract 环境配置,新手编译门槛较高

适用场景

  • 从视频或直播画面中提取字幕文字
  • 识别游戏界面或软件弹窗中无法复制的文本
  • 快速摘录 PDF 扫描件或图片中的段落文字

替代项目

TextShot、Capture2Text

项目介绍

dpscreenocr 是计算机视觉领域的开源项目,由 danpla 开发,2019 年首次发布。

它收录于计算机视觉分类,该分类目前共有 480 个项目,GitHub 星标数为 296。

项目目前处于活跃维护状态,最近一次代码更新于 2026-09-28。开源免费软件,基于Tesseract OCR。

它主要面向的使用场景是:从视频或直播画面中提取字幕文字。同类可对比的替代方案包括 TextShot、Capture2Text。

上一篇:VGGT-Det-CVPR2026

下一篇:TextGrabber2

同类项目推荐

modlens 开源

给纯文本编码代理装上眼睛,粘贴图片即刻获得结构化视觉证据。

The first vision plugin for DeepSeek Harness, and the vision bridge for every text-o···

★ 4071 2026-08-19
opencv 开源

开箱即用的视觉算法库,搞定图像视频处理与识别

Open Source Computer Vision Library

★ 91011 2026-08-10
DEIMv2 开源

用DINOv3做实时检测,又快又准,直接落地。

[DEIMv2] Real Time Object Detection Meets DINOv3

★ 2046 2026-08-14
OpenCVTutorials 开源

中文 OpenCV 教程,从入门到实战,边看边跑代码

OpenCV-Python4.1 中文文档

★ 1431 2026-08-20