
eSearch-OCR
npm 装完就能在 JS 里跑 PaddleOCR 取字。
eSearch-OCR 是一个基于 PaddleOCR 的 JavaScript/TypeScript OCR 库,目标是在 Node.js 与浏览器环境中直接完成文字识别,而不必依赖 Python 服务。它把 PaddleOCR 的检测与识别模型转换为 ONNX 格式,通过 onnxruntime 在 JS 侧推理,并集成版面分析能力,可对图片中的文本区域进行定位、排序与内容提取。项目解决的核心问题是前端或 Node 应用接入 OCR 时部署链路长、跨语言调用麻烦的问题,让开发者用 npm 安装即可获得接近原生 PaddleOCR 的识别效果。核心能力包括:多语言文本检测与识别、版面结构分析、图片输入输出、可配置的模型加载方式,适合做截图取字、文档扫描、图片信息抽取等场景。作为早期项目,API 与模型管理方式仍在演进,适合愿意跟进迭代的开发者尝试。
项目数据
使用教程
核心亮点
- 用 ONNX 在 JS 侧推理,无需额外部署 Python 服务
- 基于 PaddleOCR 模型,中文识别效果有成熟方案背书
- 同时提供文字检测、识别与版面分析能力,不只是单点 OCR
不足之处
- 星标仅 130,社区规模小,遇到问题可参考的资料有限
- 早期项目,API 与模型加载方式可能随版本变化
适用场景
- 浏览器端截图或上传图片后直接提取文字
- Node.js 后端批量处理扫描件、发票等图片文字
- 需要版面分析的应用,如按区域抽取文档内容
替代项目
tesseract.js、PaddleOCR、RapidOCR
项目介绍
上一篇:scribeocr
下一篇:PaddleOCRApi
同类项目推荐
modlens
开源
给纯文本编码代理装上眼睛,粘贴图片即刻获得结构化视觉证据。
The first vision plugin for DeepSeek Harness, and the vision bridge for every text-o···
opencv
开源
开箱即用的视觉算法库,搞定图像视频处理与识别
Open Source Computer Vision Library
OpenCVTutorials
开源
中文 OpenCV 教程,从入门到实战,边看边跑代码
OpenCV-Python4.1 中文文档
DEIMv2
开源
用DINOv3做实时检测,又快又准,直接落地。
[DEIMv2] Real Time Object Detection Meets DINOv3