
Looking-Back-OCR
用 AI 把越南语古籍旧书扫描件转成可编辑文字
Looking-Back-OCR 是一个面向越南语古籍与文档的 OCR 工具,基于 TypeScript 开发,通过封装 Gemini API 或 Meta AI 实现文字识别。它主要解决越南语旧书、历史文献数字化困难的问题:这类资料字体特殊、排版复杂、年代久远,通用 OCR 往往识别率低。项目提供 AI 模型调用封装,用户可切换 Gemini 或 Meta AI 作为识别后端,对扫描页进行文字提取。核心能力包括多后端 AI 接入、针对越南语古籍的识别优化、以及便于集成到文档数字化流程的接口。适合图书馆、研究者、家谱整理者等需要批量处理越南语旧资料的场景,属于早期项目,星标约 104。
开源
unknown
计算机视觉
GitHub 星标
★ 104
维护状态
较活跃
是否开源
是
定价模式
unknown
项目数据
分类计算机视觉
开发团队kiencang
所属国家
定价模式unknown
价格说明定价信息待确认
访问状态
是否开源是
开源协议MIT
主要语言TypeScript
技术栈/模型ai-studio,ai-wrapper,gemini-api,meta-ai,ocr,vietnamese
GitHub 星标★ 104
30天Star增速
HF 下载量
上线时间2026-08-14 00:00:00
最近更新2026-09-18 00:00:00
维护状态较活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-19
浏览次数0
使用教程
核心亮点
- 同时封装 Gemini 与 Meta AI 两个后端,可切换对比识别效果
- 专门针对越南语古籍场景,比通用 OCR 更贴合旧字体与排版
- TypeScript 编写,接口清晰,便于二次集成到数字化流程
不足之处
- 依赖第三方 AI API,需自备密钥且受调用配额与费用限制
- 项目较早期,文档与社区生态待观察
适用场景
- 图书馆或档案馆批量数字化越南语旧书
- 研究者整理越南语历史文献与手稿
- 家谱、旧报刊等个人资料的文字提取
替代项目
Tesseract、PaddleOCR
项目介绍
上一篇:oar-ocr
同类项目推荐
modlens
开源
给纯文本编码代理装上眼睛,粘贴图片即刻获得结构化视觉证据。
The first vision plugin for DeepSeek Harness, and the vision bridge for every text-o···
opencv
开源
开箱即用的视觉算法库,搞定图像视频处理与识别
Open Source Computer Vision Library
OpenCVTutorials
开源
中文 OpenCV 教程,从入门到实战,边看边跑代码
OpenCV-Python4.1 中文文档
DEIMv2
开源
用DINOv3做实时检测,又快又准,直接落地。
[DEIMv2] Real Time Object Detection Meets DINOv3