
desk-ocr
框选屏幕任意区域,OCR 取字后直接搜索,省去手动录入。
desk-ocr 是一个基于 TypeScript 开发的桌面端 OCR 工具,核心功能是截取屏幕任意区域,调用 OCR 引擎识别其中的文字,并立即对识别结果进行搜索。它解决的是日常工作中遇到图片、PDF 截图、视频画面或无法复制的界面文字时,手动录入效率低、易出错的问题。用户只需框选屏幕区域,工具就能自动提取文字,并支持一键跳转搜索引擎或本地搜索,省去复制粘贴的中间步骤。项目采用 TypeScript 编写,适合前端开发者阅读和二次开发,当前处于早期阶段,星标约 108,功能聚焦、代码结构清晰,适合作为 OCR 桌面工具的原型或轻量级替代方案。
开源
free
计算机视觉
GitHub 星标
★ 108
维护状态
较活跃
是否开源
是
定价模式
free
项目数据
分类计算机视觉
开发团队sekirro
所属国家
定价模式free
价格说明开源免费使用
访问状态
是否开源是
开源协议MIT
主要语言TypeScript
技术栈/模型
GitHub 星标★ 108
30天Star增速
HF 下载量
上线时间2026-05-25 00:00:00
最近更新2026-09-09 00:00:00
维护状态较活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-19
浏览次数0
使用教程
核心亮点
- 截屏、OCR、搜索三步合一,操作路径短,适合快速查资料
- TypeScript 实现,前端技术栈友好,便于二次开发和集成
- 聚焦屏幕取字搜索这一高频场景,功能定位清晰不臃肿
不足之处
- 项目处于早期,功能完整度和稳定性有待验证
- 文档和社区生态较薄弱,遇到问题可参考的资料有限
适用场景
- 看视频或直播时遇到无法复制的字幕,框选后直接搜索关键词
- 阅读扫描版 PDF 或图片资料时,快速提取文字并检索出处
- 日常办公中从截图、报错弹窗里取字,直接搜索解决方案
替代项目
Tesseract.js、PaddleOCR、Umi-OCR
项目介绍
同类项目推荐
modlens
开源
给纯文本编码代理装上眼睛,粘贴图片即刻获得结构化视觉证据。
The first vision plugin for DeepSeek Harness, and the vision bridge for every text-o···
opencv
开源
开箱即用的视觉算法库,搞定图像视频处理与识别
Open Source Computer Vision Library
OpenCVTutorials
开源
中文 OpenCV 教程,从入门到实战,边看边跑代码
OpenCV-Python4.1 中文文档
DEIMv2
开源
用DINOv3做实时检测,又快又准,直接落地。
[DEIMv2] Real Time Object Detection Meets DINOv3