TeleOCR

Telegram 图片自动转文字,聊天记录秒变可搜索文本

TeleOCR 是一个基于 Python 的开源 OCR 工具,主要面向从 Telegram 聊天记录、频道或群组中批量提取图片文字的场景。它把 Telegram 消息抓取与 OCR 识别串联起来,用户只需配置好账号或机器人凭证,就能自动下载消息中的图片并调用 OCR 引擎识别文字,最终输出可检索的文本结果。项目解决的是手动保存图片、逐张识别效率低的问题,适合需要监控特定频道、整理群组资料或做舆情信息收集的用户。核心能力包括:对接 Telegram API 获取消息与媒体文件、支持图片文字识别、可按关键词或时间范围筛选消息、将识别结果结构化保存。整体定位轻量,依赖 Python 生态,适合个人或小团队快速搭建自动化文字提取流程。

开源 free 计算机视觉
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 204
维护状态 活跃
是否开源
定价模式 free

项目数据

分类计算机视觉
开发团队caipeng328
所属国家
官网地址
定价模式free
价格说明开源免费,无官网定价信息
访问状态
是否开源
开源协议
主要语言Python
技术栈/模型
GitHub 星标★ 204
30天Star增速
HF 下载量
上线时间2026-08-13 00:00:00
最近更新2026-09-18 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-19
浏览次数0

使用教程

核心亮点

  • 把 Telegram 消息抓取和 OCR 识别串成一条自动化流水线,省去手动下载和逐张识别
  • 基于 Python,依赖清晰,便于二次开发和接入自有 OCR 引擎
  • 面向频道/群组批量处理,适合持续监控和资料归档场景

不足之处

  • 项目星标仅 204,属于早期阶段,功能和稳定性可能还不够成熟
  • 文档和社区规模有限,遇到问题可参考的资料较少

适用场景

  • 监控特定 Telegram 频道,自动提取图片中的通知或公告文字
  • 整理群组聊天中的图片资料,批量转成可搜索文本存档
  • 做舆情或情报收集时,从 Telegram 图片中快速提取关键信息

替代项目

PaddleOCR、EasyOCR

项目介绍

TeleOCR 是一个计算机视觉领域的开源项目,官方简介:暂无简介。项目使用 Python 开发,在 GitHub 上获得 204 星标。

上一篇:ppu-paddle-ocr

下一篇:desk-ocr

同类项目推荐

modlens 开源

给纯文本编码代理装上眼睛,粘贴图片即刻获得结构化视觉证据。

The first vision plugin for DeepSeek Harness, and the vision bridge for every text-o···

★ 3973 2026-08-19
opencv 开源

开箱即用的视觉算法库,搞定图像视频处理与识别

Open Source Computer Vision Library

★ 90860 2026-08-10
OpenCVTutorials 开源

中文 OpenCV 教程,从入门到实战,边看边跑代码

OpenCV-Python4.1 中文文档

★ 1430 2026-08-20
DEIMv2 开源

用DINOv3做实时检测,又快又准,直接落地。

[DEIMv2] Real Time Object Detection Meets DINOv3

★ 2032 2026-08-14