tesseract

本站收录 14 个带「tesseract」标签的 AI 开源项目

tesseractTesseract 是当前最知名的开源 OCR(光学字符识别)引擎,由惠普实验室诞生、Google 主导维护。它解决的核心问题是从图片中提取文字,支持超过 10★ 76,756OCRmyPDFOCRmyPDF 是一个开源命令行工具,专门为扫描版 PDF 文件添加 OCR 文本层,让原本不可搜索的扫描文档变得可搜索、可复制、可索引。它解决的核心问题是:★ 34,903PyMuPDFPyMuPDF 是一个高性能的 Python 库,用于 PDF 及其他文档(如 EPUB)的数据提取、分析、转换和操作。它基于 MuPDF 引擎,提供丰富的 A★ 10,808xbergxberg 是一个多语言文档智能框架,核心用 Rust 编写,旨在解决文档解析碎片化问题。它能从 101 种格式(涵盖 115 种文件扩展名)中提取文本、元数据★ 9,356TagUITagUI 是由 AI Singapore 开发的一款免费开源 RPA(机器人流程自动化)工具,旨在帮助用户通过自然语言或可视化方式快速构建自动化流程。它解决了★ 6,338RPA-PythonRPA-Python 是一个基于 Python 的机器人流程自动化(RPA)库,旨在帮助开发者用代码替代重复性的人工操作。它解决了传统 RPA 工具依赖重型图形★ 5,504llm_aided_ocrllm_aided_ocr 是一个利用大语言模型(LLM)增强 Tesseract OCR 输出的开源工具。它解决传统 OCR 识别率低、输出格式杂乱的问题,通★ 3,004J.A.R.V.I.SJ.A.R.V.I.S 是一个基于 Python 的个人语音助手项目,灵感来源于钢铁侠的 AI 管家。它旨在通过语音命令简化日常任务,解决用户在多设备间切换、手★ 1,382scribeocrScribeOCR 是一个基于浏览器的 OCR 文字识别与校对工具,目标是把扫描图片、PDF 或已有 OCR 结果变成完全数字化的文档。它本身不训练识别模型,而★ 813ocr-itocr-it 是一款 Chrome 浏览器扩展,专为需要反复识别同一屏幕区域文字的用户设计。它解决的核心问题是:在阅读分页文档、PDF 阅读器或网页长文时,用户★ 405scribe.jsscribe.js 是一个纯 JavaScript 的 OCR 与文本提取库,可在浏览器和 Node.js 中直接识别图片与 PDF 中的文字,无需后端服务或本★ 322dpscreenocrdpscreenocr 是一个用 C++ 编写的屏幕文字识别工具,基于 Tesseract OCR 引擎,能够直接截取屏幕区域并识别其中的文字内容。它解决的是用★ 296tesseracttesseract 是一个为 R 语言提供 Tesseract OCR 引擎绑定的开源包,让 R 用户无需离开统计与数据分析环境即可对图片做文字识别。它解决的核★ 251Audio-book-generatorAudio-book-generator 是一个将电子书转换为有声书的 Python 工具。它解决的是用户没时间阅读电子书、或希望以听觉方式获取书籍内容的问题。★ 72