
TeleOCR
Telegram 图片自动转文字,聊天记录秒变可搜索文本
TeleOCR 是一个基于 Python 的开源 OCR 工具,主要面向从 Telegram 聊天记录、频道或群组中批量提取图片文字的场景。它把 Telegram 消息抓取与 OCR 识别串联起来,用户只需配置好账号或机器人凭证,就能自动下载消息中的图片并调用 OCR 引擎识别文字,最终输出可检索的文本结果。项目解决的是手动保存图片、逐张识别效率低的问题,适合需要监控特定频道、整理群组资料或做舆情信息收集的用户。核心能力包括:对接 Telegram API 获取消息与媒体文件、支持图片文字识别、可按关键词或时间范围筛选消息、将识别结果结构化保存。整体定位轻量,依赖 Python 生态,适合个人或小团队快速搭建自动化文字提取流程。
开源
free
计算机视觉
GitHub 星标
★ 204
维护状态
活跃
是否开源
是
定价模式
free
项目数据
分类计算机视觉
开发团队caipeng328
所属国家
定价模式free
价格说明开源免费,无官网定价信息
访问状态
是否开源是
开源协议
主要语言Python
技术栈/模型
GitHub 星标★ 204
30天Star增速
HF 下载量
上线时间2026-08-13 00:00:00
最近更新2026-09-18 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-19
浏览次数0
使用教程
核心亮点
- 把 Telegram 消息抓取和 OCR 识别串成一条自动化流水线,省去手动下载和逐张识别
- 基于 Python,依赖清晰,便于二次开发和接入自有 OCR 引擎
- 面向频道/群组批量处理,适合持续监控和资料归档场景
不足之处
- 项目星标仅 204,属于早期阶段,功能和稳定性可能还不够成熟
- 文档和社区规模有限,遇到问题可参考的资料较少
适用场景
- 监控特定 Telegram 频道,自动提取图片中的通知或公告文字
- 整理群组聊天中的图片资料,批量转成可搜索文本存档
- 做舆情或情报收集时,从 Telegram 图片中快速提取关键信息
替代项目
PaddleOCR、EasyOCR
项目介绍
上一篇:ppu-paddle-ocr
下一篇:desk-ocr
同类项目推荐
modlens
开源
给纯文本编码代理装上眼睛,粘贴图片即刻获得结构化视觉证据。
The first vision plugin for DeepSeek Harness, and the vision bridge for every text-o···
opencv
开源
开箱即用的视觉算法库,搞定图像视频处理与识别
Open Source Computer Vision Library
OpenCVTutorials
开源
中文 OpenCV 教程,从入门到实战,边看边跑代码
OpenCV-Python4.1 中文文档
DEIMv2
开源
用DINOv3做实时检测,又快又准,直接落地。
[DEIMv2] Real Time Object Detection Meets DINOv3