image-reader

网页图片框选即出文字,还能接入 AI 工作流

image-reader 是一款浏览器 OCR 扩展,支持 Chrome、Edge、Firefox,核心功能是让用户在网页上直接框选图片区域并识别其中的文字,无需下载图片或切换工具。它解决了日常浏览网页时遇到图片内文字无法复制的问题,比如截图、海报、扫描件、PDF 预览图等场景。扩展内置区域选择工具,可精确框选识别范围,同时提供 MCP Server 能力,可被支持 MCP 协议的 AI 客户端调用,把图片文字识别能力接入自动化工作流。项目用 JavaScript 编写,安装即用,轻量且跨浏览器。适合需要频繁提取网页图片文字的用户,也适合开发者将其作为 OCR 能力接入自己的 AI 工具链。

开源 free 计算机视觉
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 127
维护状态 较活跃
是否开源
定价模式 free

项目数据

分类计算机视觉
开发团队brian-girko
所属国家
定价模式free
价格说明免费浏览器扩展,开源免费使用
访问状态
是否开源
开源协议MPL-2.0
主要语言JavaScript
技术栈/模型chrome-extension,edge-extension,firefox-addon,mcp-server
GitHub 星标★ 127
30天Star增速
HF 下载量
上线时间2019-06-17 00:00:00
最近更新2026-09-08 00:00:00
维护状态较活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-19
浏览次数0

使用教程

核心亮点

  • 支持 Chrome、Edge、Firefox 三大浏览器,覆盖面广
  • 内置区域选择工具,可精确框选识别范围而非整图识别
  • 提供 MCP Server,能被 AI 客户端调用,扩展了 OCR 的使用边界

不足之处

  • 项目星标仅 127,属于早期阶段,文档和社区生态待观察
  • OCR 识别精度依赖底层引擎,复杂排版或低质量图片效果可能不稳定

适用场景

  • 浏览网页时遇到图片里的文字需要复制,直接框选识别
  • 把网页截图或海报中的文字提取出来做笔记或翻译
  • 通过 MCP 接入 AI 助手,让 AI 自动读取图片中的文字内容

替代项目

tesseract.js、ocrmypdf

项目介绍

image-reader 是一个计算机视觉领域的开源项目,官方简介:A powerful OCR extension with area selection tool and more。项目使用 JavaScript 开发,在 GitHub 上获得 127 星标。

上一篇:scribe.js

下一篇:obsidian-text-extractor

同类项目推荐

modlens 开源

给纯文本编码代理装上眼睛,粘贴图片即刻获得结构化视觉证据。

The first vision plugin for DeepSeek Harness, and the vision bridge for every text-o···

★ 3973 2026-08-19
opencv 开源

开箱即用的视觉算法库,搞定图像视频处理与识别

Open Source Computer Vision Library

★ 90860 2026-08-10
OpenCVTutorials 开源

中文 OpenCV 教程,从入门到实战,边看边跑代码

OpenCV-Python4.1 中文文档

★ 1430 2026-08-20
DEIMv2 开源

用DINOv3做实时检测,又快又准,直接落地。

[DEIMv2] Real Time Object Detection Meets DINOv3

★ 2032 2026-08-14