
image-reader
网页图片框选即出文字,还能接入 AI 工作流
image-reader 是一款浏览器 OCR 扩展,支持 Chrome、Edge、Firefox,核心功能是让用户在网页上直接框选图片区域并识别其中的文字,无需下载图片或切换工具。它解决了日常浏览网页时遇到图片内文字无法复制的问题,比如截图、海报、扫描件、PDF 预览图等场景。扩展内置区域选择工具,可精确框选识别范围,同时提供 MCP Server 能力,可被支持 MCP 协议的 AI 客户端调用,把图片文字识别能力接入自动化工作流。项目用 JavaScript 编写,安装即用,轻量且跨浏览器。适合需要频繁提取网页图片文字的用户,也适合开发者将其作为 OCR 能力接入自己的 AI 工具链。
开源
free
计算机视觉
GitHub 星标
★ 127
维护状态
较活跃
是否开源
是
定价模式
free
项目数据
分类计算机视觉
开发团队brian-girko
所属国家
定价模式free
价格说明免费浏览器扩展,开源免费使用
访问状态
是否开源是
开源协议MPL-2.0
主要语言JavaScript
技术栈/模型chrome-extension,edge-extension,firefox-addon,mcp-server
GitHub 星标★ 127
30天Star增速
HF 下载量
上线时间2019-06-17 00:00:00
最近更新2026-09-08 00:00:00
维护状态较活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-19
浏览次数0
使用教程
核心亮点
- 支持 Chrome、Edge、Firefox 三大浏览器,覆盖面广
- 内置区域选择工具,可精确框选识别范围而非整图识别
- 提供 MCP Server,能被 AI 客户端调用,扩展了 OCR 的使用边界
不足之处
- 项目星标仅 127,属于早期阶段,文档和社区生态待观察
- OCR 识别精度依赖底层引擎,复杂排版或低质量图片效果可能不稳定
适用场景
- 浏览网页时遇到图片里的文字需要复制,直接框选识别
- 把网页截图或海报中的文字提取出来做笔记或翻译
- 通过 MCP 接入 AI 助手,让 AI 自动读取图片中的文字内容
替代项目
tesseract.js、ocrmypdf
项目介绍
上一篇:scribe.js
同类项目推荐
modlens
开源
给纯文本编码代理装上眼睛,粘贴图片即刻获得结构化视觉证据。
The first vision plugin for DeepSeek Harness, and the vision bridge for every text-o···
opencv
开源
开箱即用的视觉算法库,搞定图像视频处理与识别
Open Source Computer Vision Library
OpenCVTutorials
开源
中文 OpenCV 教程,从入门到实战,边看边跑代码
OpenCV-Python4.1 中文文档
DEIMv2
开源
用DINOv3做实时检测,又快又准,直接落地。
[DEIMv2] Real Time Object Detection Meets DINOv3