desk-ocr

框选屏幕任意区域,OCR 取字后直接搜索,省去手动录入。

desk-ocr 是一个基于 TypeScript 开发的桌面端 OCR 工具,核心功能是截取屏幕任意区域,调用 OCR 引擎识别其中的文字,并立即对识别结果进行搜索。它解决的是日常工作中遇到图片、PDF 截图、视频画面或无法复制的界面文字时,手动录入效率低、易出错的问题。用户只需框选屏幕区域,工具就能自动提取文字,并支持一键跳转搜索引擎或本地搜索,省去复制粘贴的中间步骤。项目采用 TypeScript 编写,适合前端开发者阅读和二次开发,当前处于早期阶段,星标约 108,功能聚焦、代码结构清晰,适合作为 OCR 桌面工具的原型或轻量级替代方案。

开源 free 计算机视觉
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 108
维护状态 较活跃
是否开源
定价模式 free

项目数据

分类计算机视觉
开发团队sekirro
所属国家
官网地址
定价模式free
价格说明开源免费使用
访问状态
是否开源
开源协议MIT
主要语言TypeScript
技术栈/模型
GitHub 星标★ 108
30天Star增速
HF 下载量
上线时间2026-05-25 00:00:00
最近更新2026-09-09 00:00:00
维护状态较活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-19
浏览次数0

使用教程

核心亮点

  • 截屏、OCR、搜索三步合一,操作路径短,适合快速查资料
  • TypeScript 实现,前端技术栈友好,便于二次开发和集成
  • 聚焦屏幕取字搜索这一高频场景,功能定位清晰不臃肿

不足之处

  • 项目处于早期,功能完整度和稳定性有待验证
  • 文档和社区生态较薄弱,遇到问题可参考的资料有限

适用场景

  • 看视频或直播时遇到无法复制的字幕,框选后直接搜索关键词
  • 阅读扫描版 PDF 或图片资料时,快速提取文字并检索出处
  • 日常办公中从截图、报错弹窗里取字,直接搜索解决方案

替代项目

Tesseract.js、PaddleOCR、Umi-OCR

项目介绍

desk-ocr 是一个计算机视觉领域的开源项目,官方简介:Capture your screen, extract text with OCR, and instantly search the recognized content.。项目使用 TypeScript 开发,在 GitHub 上获得 108 星标。

上一篇:TeleOCR

下一篇:scribeocr

同类项目推荐

modlens 开源

给纯文本编码代理装上眼睛,粘贴图片即刻获得结构化视觉证据。

The first vision plugin for DeepSeek Harness, and the vision bridge for every text-o···

★ 3973 2026-08-19
opencv 开源

开箱即用的视觉算法库,搞定图像视频处理与识别

Open Source Computer Vision Library

★ 90860 2026-08-10
OpenCVTutorials 开源

中文 OpenCV 教程,从入门到实战,边看边跑代码

OpenCV-Python4.1 中文文档

★ 1430 2026-08-20
DEIMv2 开源

用DINOv3做实时检测,又快又准,直接落地。

[DEIMv2] Real Time Object Detection Meets DINOv3

★ 2032 2026-08-14