tg_bot_stt_tts

让 Telegram 语音秒变文字,文字也能开口说话

这是一个基于 Python 的 Telegram 机器人,核心功能是语音消息的识别与生成,即语音转文字(STT)和文字转语音(TTS)。它解决了在 Telegram 聊天中无法直接处理语音消息的问题,用户发送语音后,机器人会自动转成文字回复,也可以将文字转为语音发送。项目采用 aiogram 框架构建,集成了 Vosk 和 Silero 等主流语音处理库,支持离线识别和合成,并利用 ffmpeg 处理音频格式转换。技术栈还包括 num2words 用于数字转文字,torch 作为深度学习后端。目前项目处于早期阶段,星标数不多,但功能明确,适合对 Telegram 语音交互感兴趣的开发者二次开发或学习。

开源 free 音频音乐
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 68
维护状态 低维护
是否开源 是
定价模式 free

项目数据

分类音频音乐
开发团队tochilkinva
所属国家
官网地址
定价模式free
价格说明开源项目,MIT许可证,可免费自行部署使用。
访问状态
是否开源是
开源协议MIT
主要语言Python
技术栈/模型aiogram,ffmpeg,num2words,silero,speech-to-text,text-to-speech,torch,vosk
GitHub 星标★ 68
30天Star增速
HF 下载量
上线时间2022-10-04 00:00:00
最近更新2026-04-09 00:00:00
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数3

使用教程

核心亮点

  • 集成 Vosk 和 Silero,支持离线语音识别与合成,不依赖外部 API
  • 使用 aiogram 异步框架,处理消息高效,适合 Telegram 机器人场景
  • 通过 ffmpeg 自动处理音频格式,兼容多种语音消息

不足之处

  • 项目早期,文档和示例可能不够完善
  • 语音识别准确率受限于 Vosk 模型,对中文等语言支持需额外配置

适用场景

  • Telegram 群聊中自动转写语音消息为文字,方便阅读
  • 为视障用户提供语音播报文字消息的功能
  • 构建语音交互式 Telegram 助手,实现语音指令控制

替代项目

telegram-voice-to-text-bot、whisper-telegram-bot、tg-voice-bot

项目介绍

tg_bot_stt_tts 是语音识别领域的开源项目,由 tochilkinva 开发,2022 年首次发布。

它收录于语音识别分类,该分类目前共有 212 个项目,GitHub 星标数为 68。

项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-04-09。MIT许可证,可免费自行部署使用。

它主要面向的使用场景是:Telegram群聊中自动转写语音消息为文字,方便阅读。同类可对比的替代方案包括 telegram-voice-to-text-bot、whisper-telegram-bot、tg-voice-bot。

上一篇:whisper-shortcut

下一篇:speech-core

同类项目推荐

obs-localvocal 开源

直播录屏时,本地AI实时生成字幕,保护隐私零延迟

OBS plugin for local speech recognition and captioning using AI

★ 1616 2026-09-10
LiveCaptions-Translator 开源

实时捕获系统音频,一键翻译成你懂的语言

Lightweight and powerful real-time audio/speech translation tool based on Windows Li···

★ 3755 2026-08-10
speechbrain 开源

一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务

A PyTorch-based Speech Toolkit

★ 11834 2026-08-26
whisper-diarization 开源

给语音转写加上说话人标签,会议记录一目了然

Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper

★ 5657 2026-08-13