phonikud 是语音识别领域的开源项目,由 phonikud 开发,2025 年首次发布。
它收录于语音识别分类,该分类目前共有 212 个项目,GitHub 星标数为 115。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-10。提供在线网页演示,完全免费使用。从国内网络环境看,可直接访问。
它主要面向的使用场景是:希伯来语语音合成系统前端文本处理。同类可对比的替代方案包括 g2p-en、Phonetisaurus、g2pM。

给希伯来文本自动标音,让TTS发音更准
phonikud 是一个面向希伯来语的文本到音素(grapheme-to-phoneme, G2P)转换工具,相关论文已被 INTERSPEECH 2026 接收。它解决了希伯来语文本缺少元音符号(nikud)导致发音不明确的问题,能够将无元音的希伯来文自动转换为准确的音素序列,为语音合成(TTS)、语音识别(ASR)等下游任务提供关键支持。项目基于 Python 实现,结合语言学规则与机器学习方法,核心能力包括高精度的音素预测、对现代希伯来语多种拼写变体的适应,以及易于集成的 API 接口。作为早期开源项目,它提供了训练和推理代码,适合研究者和开发者用于希伯来语语音技术研发。
g2p-en、Phonetisaurus、g2pM
phonikud 是语音识别领域的开源项目,由 phonikud 开发,2025 年首次发布。
它收录于语音识别分类,该分类目前共有 212 个项目,GitHub 星标数为 115。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-10。提供在线网页演示,完全免费使用。从国内网络环境看,可直接访问。
它主要面向的使用场景是:希伯来语语音合成系统前端文本处理。同类可对比的替代方案包括 g2p-en、Phonetisaurus、g2pM。
上一篇:lingvo
下一篇:fast-langdetect
obs-localvocal
开源
直播录屏时,本地AI实时生成字幕,保护隐私零延迟
OBS plugin for local speech recognition and captioning using AI
LiveCaptions-Translator
开源
实时捕获系统音频,一键翻译成你懂的语言
Lightweight and powerful real-time audio/speech translation tool based on Windows Li···
speechbrain
开源
一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务
A PyTorch-based Speech Toolkit
whisper-diarization
开源
给语音转写加上说话人标签,会议记录一目了然
Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper