ocr-it

框选一次屏幕区域,快捷键反复离线取字

ocr-it 是一款 Chrome 浏览器扩展,专为需要反复识别同一屏幕区域文字的用户设计。它解决的核心问题是:在阅读分页文档、PDF 阅读器或网页长文时,用户往往需要不断框选新区域再触发 OCR,操作繁琐。ocr-it 允许你一次性框选屏幕上的固定区域,之后通过快捷键即可对该区域反复执行 OCR,翻页后无需重新框选。识别引擎采用打包进扩展的 Tesseract,通过 WASM 在本地运行,全程离线,不上传任何截图或识别结果,隐私性好。技术栈为 Manifest V3 + JavaScript,安装即用,无需配置 API Key 或联网。适合处理扫描版 PDF、图片型文档、无法复制的网页文本等场景,是轻量级的屏幕取字工具。

开源 free 计算机视觉
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 395
维护状态 较活跃
是否开源
定价模式 free

项目数据

分类计算机视觉
开发团队thiagotigaz
所属国家
定价模式free
价格说明开源免费Chrome扩展,本地离线运行
访问状态
是否开源
开源协议MIT
主要语言JavaScript
技术栈/模型chrome-extension,javascript,manifest-v3,ocr,offline-first,tesseract,wasm
GitHub 星标★ 395
30天Star增速
HF 下载量
上线时间2026-08-21 00:00:00
最近更新2026-09-17 00:00:00
维护状态较活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-19
浏览次数0

使用教程

核心亮点

  • 框选区域后可用快捷键反复识别,翻页阅读场景下省去重复框选
  • Tesseract 与 WASM 全部打包在扩展内,识别完全离线,截图不外传
  • 基于 Manifest V3,安装即用,不需要 API Key 或后端服务

不足之处

  • Tesseract 对复杂排版、低分辨率或手写体识别准确率有限
  • 仅支持 Chrome 系浏览器,无法在 Firefox 或 Safari 使用

适用场景

  • 阅读扫描版 PDF 或图片型文档时逐页提取文字
  • 在禁止复制的网页或在线课件中快速取词
  • 对照纸质书或另一块屏幕上的内容做笔记摘录

替代项目

Tesseract.js、Copyfish、Project Naptha

项目介绍

ocr-it 是一个计算机视觉领域的开源项目,官方简介:Chrome extension: pin a screen region once, then hotkey your way through a paginated document. OCR runs 100% offline via bundled Tesseract.。项目使用 JavaScript 开发,在 GitHub 上获得 395 星标。

上一篇:pdf-ocr-obsidian

下一篇:SimdPaddleOCR

同类项目推荐

modlens 开源

给纯文本编码代理装上眼睛,粘贴图片即刻获得结构化视觉证据。

The first vision plugin for DeepSeek Harness, and the vision bridge for every text-o···

★ 3995 2026-08-19
opencv 开源

开箱即用的视觉算法库,搞定图像视频处理与识别

Open Source Computer Vision Library

★ 90893 2026-08-10
OpenCVTutorials 开源

中文 OpenCV 教程,从入门到实战,边看边跑代码

OpenCV-Python4.1 中文文档

★ 1430 2026-08-20
DEIMv2 开源

用DINOv3做实时检测,又快又准,直接落地。

[DEIMv2] Real Time Object Detection Meets DINOv3

★ 2035 2026-08-14