text-recognition

本站收录 13 个带「text-recognition」标签的 AI 开源项目

doctrdocTR 是一个基于深度学习的 OCR 库,专注于文档文本识别,由 t2k 团队持续维护。它解决了从文档图像中高效、准确地检测和识别文字的问题,提供了文本检测★ 6,367mlkitmlkit 是 Google 官方维护的 ML Kit 示例应用集合,覆盖 Android 和 iOS 双平台。它通过完整可运行的代码演示了 ML Kit 的核★ 4,298TurboOCRTurboOCR 是一个基于 C++ 实现的高性能 OCR 服务,专为追求极致吞吐量的场景设计。它集成了百度飞桨的 PP-OCRv6 模型,并利用 Tensor★ 1,098Total-Text-DatasetTotal-Text-Dataset 是一个用于场景文本检测与识别的公开数据集,包含1555张图像,覆盖水平、多方向和弯曲三种文本形态,尤其以弯曲文本为特色,是★ 772kirikiri 是一款用 Rust 编写的本地优先桌面工作台,把截图、标注、OCR 文字识别和屏幕录制整合在一个应用里。它解决的是日常工作中截图工具、标注软件、OCR★ 537mac-ocrmac-ocr 是一个基于苹果 Vision 框架的 macOS 命令行工具,用 Swift 编写,用于对图片和 PDF 做文字识别,并生成可搜索的 PDF。它★ 521light-ocrlight-ocr 是一个面向 Node.js 和 C++ 的快速离线 OCR 库,基于 PP-OCRv6 模型,解决在本地环境中进行文字识别时依赖云端 API★ 508awesome-ocr-resourcesawesome-ocr-resources 是一个面向 OCR(光学字符识别)领域的资源聚合项目,系统整理了该方向的重要论文、公开数据集与工具链接。它解决的是 ★ 437compvcompv 是一个面向 ARM 和 x86 设备的开源计算机视觉库,主打极致性能,官方宣称在部分任务上比 OpenCV 快最多 50 倍。它用 C++ 编写,并★ 212DTrOCRDTrOCR 是论文《DTrOCR: Decoder-only Transformer for Optical Character Recognition》的 ★ 206OnnxTROnnxTR 是 docTR 文档文本识别库的 ONNX 推理管线封装,目标是在不依赖深度学习训练框架的前提下提供高性能、易接入的 OCR 能力。它把 docT★ 197awesome-ai-services这是一个汇总AI即服务(AI-as-a-Service)领域资源与工具的精选列表项目。它系统梳理了当前市场上各类AI服务,覆盖计算机视觉、人脸识别、实体识别、关★ 161ppu-paddle-ocrppu-paddle-ocr 是一个用 TypeScript 重写的 PaddleOCR 轻量级 SDK,目标是在任何能运行 JavaScript 的环境里做多★ 138