Looking-Back-OCR

用 AI 把越南语古籍旧书扫描件转成可编辑文字

Looking-Back-OCR 是一个面向越南语古籍与文档的 OCR 工具,基于 TypeScript 开发,通过封装 Gemini API 或 Meta AI 实现文字识别。它主要解决越南语旧书、历史文献数字化困难的问题:这类资料字体特殊、排版复杂、年代久远,通用 OCR 往往识别率低。项目提供 AI 模型调用封装,用户可切换 Gemini 或 Meta AI 作为识别后端,对扫描页进行文字提取。核心能力包括多后端 AI 接入、针对越南语古籍的识别优化、以及便于集成到文档数字化流程的接口。适合图书馆、研究者、家谱整理者等需要批量处理越南语旧资料的场景,属于早期项目,星标约 104。

开源 unknown 计算机视觉
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 104
维护状态 较活跃
是否开源
定价模式 unknown

项目数据

分类计算机视觉
开发团队kiencang
所属国家
定价模式unknown
价格说明定价信息待确认
访问状态
是否开源
开源协议MIT
主要语言TypeScript
技术栈/模型ai-studio,ai-wrapper,gemini-api,meta-ai,ocr,vietnamese
GitHub 星标★ 104
30天Star增速
HF 下载量
上线时间2026-08-14 00:00:00
最近更新2026-09-18 00:00:00
维护状态较活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-19
浏览次数0

使用教程

核心亮点

  • 同时封装 Gemini 与 Meta AI 两个后端,可切换对比识别效果
  • 专门针对越南语古籍场景,比通用 OCR 更贴合旧字体与排版
  • TypeScript 编写,接口清晰,便于二次集成到数字化流程

不足之处

  • 依赖第三方 AI API,需自备密钥且受调用配额与费用限制
  • 项目较早期,文档与社区生态待观察

适用场景

  • 图书馆或档案馆批量数字化越南语旧书
  • 研究者整理越南语历史文献与手稿
  • 家谱、旧报刊等个人资料的文字提取

替代项目

Tesseract、PaddleOCR

项目介绍

Looking-Back-OCR 是一个计算机视觉领域的开源项目,官方简介:Công cụ OCR tài liệu, sách xưa tiếng Việt bằng Gemini hoặc Meta AI.。项目使用 TypeScript 开发,在 GitHub 上获得 104 星标。

上一篇:oar-ocr

下一篇:vietnamese-ocr-toolbox

同类项目推荐

modlens 开源

给纯文本编码代理装上眼睛,粘贴图片即刻获得结构化视觉证据。

The first vision plugin for DeepSeek Harness, and the vision bridge for every text-o···

★ 3995 2026-08-19
opencv 开源

开箱即用的视觉算法库,搞定图像视频处理与识别

Open Source Computer Vision Library

★ 90893 2026-08-10
OpenCVTutorials 开源

中文 OpenCV 教程,从入门到实战,边看边跑代码

OpenCV-Python4.1 中文文档

★ 1430 2026-08-20
DEIMv2 开源

用DINOv3做实时检测,又快又准,直接落地。

[DEIMv2] Real Time Object Detection Meets DINOv3

★ 2035 2026-08-14