ocr-recognition
本站收录 11 个带「ocr-recognition」标签的 AI 开源项目
opendataloader-pdfopendataloader-pdf 是一个专为 AI 数据准备而设计的 PDF 解析器,旨在将 PDF 文档自动转换为 AI 可读的结构化数据。它解决了传统 ★ 29,401
ImageToolboxImageToolbox 是一款基于 Kotlin 与 Jetpack Compose 开发的开源 Android 图像处理应用,定位为手机上的全能图片工具箱。★ 14,787
liteparseliteparse 是一个用 Rust 编写的高性能开源文档解析器,专注于从 PDF、扫描件和图片中快速提取文本与结构化数据。它解决了传统 OCR 工具速度慢、★ 12,719
TaxHackerTaxHacker 是一个自托管的 AI 记账应用,利用大语言模型自动分析收据、发票和银行交易,帮助个人或小企业简化财务记录与税务准备。它通过自定义提示词和分类★ 6,724
SmartJavaAISmartJavaAI 是一个基于 Java 的免费离线 AI 算法工具箱,旨在为 Java 开发者提供开箱即用的 AI 能力,解决 Java 生态中缺乏易用 ★ 919
TexoTexo 是一个超轻量的 LaTeX 公式识别模型,参数量仅 20M,却能达到 SOTA 级别的识别精度。它主要解决数学公式 OCR 场景中模型过大、难以在浏览★ 903
RSTGameTranslationRSTGameTranslation 是一款面向 Windows 游戏玩家的开源实时翻译工具,核心思路是把 OCR 文字识别与大模型翻译串成一条流水线:截取屏幕★ 655
ExtractPDF4JExtractPDF4J 是一个用 Java 编写的 PDF 表格提取与 OCR 库,主要解决从 PDF 中稳定抽取结构化表格数据的问题。它同时支持文本型 PD★ 522
light-ocrlight-ocr 是一个面向 Node.js 和 C++ 的快速离线 OCR 库,基于 PP-OCRv6 模型,解决在本地环境中进行文字识别时依赖云端 API★ 508
Translate-ItTranslate-It 是一款开源的浏览器翻译扩展,支持 Chrome 与 Firefox,目标是把网页上的阅读、写作、听力和配音需求统一到一个工具里。它通过★ 289
compvcompv 是一个面向 ARM 和 x86 设备的开源计算机视觉库,主打极致性能,官方宣称在部分任务上比 OpenCV 快最多 50 倍。它用 C++ 编写,并★ 212