reader 是音频音乐领域的开源项目,由 xyqfer 开发,2014 年首次发布。
它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 63。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-08-03。MIT许可证,免费使用。
它主要面向的使用场景是:个人学习移动端图像识别与文字提取技术。同类可对比的替代方案包括 OpenCV Android、Tesseract OCR、CamScanner。

手机拍报纸,秒变电子版,随时读报不费力
reader 是一个基于智能手机的报纸阅读器,作为毕业设计项目,主要解决传统报纸在移动设备上阅读体验不佳的问题。它利用 Java 语言开发,通过手机摄像头拍摄报纸版面,结合图像处理和文字识别技术,将纸质报纸内容数字化,并在手机屏幕上提供清晰的阅读视图。核心能力包括报纸版面识别、文字提取、版面重构和阅读模式切换,支持缩放、翻页等基本操作。项目旨在探索一种便捷的移动端报纸阅读方式,降低纸质报纸的获取和携带成本,提升阅读便利性。虽然功能相对基础,但完整展示了从图像采集到内容呈现的流程,适合学习移动端图像处理与 OCR 技术集成。
OpenCV Android、Tesseract OCR、CamScanner
reader 是音频音乐领域的开源项目,由 xyqfer 开发,2014 年首次发布。
它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 63。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-08-03。MIT许可证,免费使用。
它主要面向的使用场景是:个人学习移动端图像识别与文字提取技术。同类可对比的替代方案包括 OpenCV Android、Tesseract OCR、CamScanner。
上一篇:spoken-word
tango
开源
输入一句话,自动生成匹配的音频内容
A family of diffusion models for text-to-audio generation.
AuK
开源
一个模型搞定语音生成、编辑与分离
AuK: An Open-Source Foundational Model for Speech Generation and Editing
swift-tts
开源
Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine
A straightforward package containing version for Swift modern concurrency, Point-Fre···
ai-dj
开源
现场演出中实时用 AI 生成音乐,保持人类掌控
AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···