Diction 是语音识别领域的开源项目,由 DictionLabs 开发,是 2026 年新上线的项目。
它收录于语音识别分类,该分类目前共有 212 个项目,GitHub 星标数为 203。
项目目前处于活跃维护状态,最近一次代码更新于 2026-09-23。开源免费,自托管使用。
它主要面向的使用场景是:在iPhone任意App里用自托管键盘做私密语音输入。同类可对比的替代方案包括 whisper.cpp、Willow、VoiceInk。

自托管语音键盘,说话直接变文字,隐私自己掌控
Diction 是一个用 Go 编写的开源自托管语音转文字方案,定位为 WisprFlow 的替代品,主打 iOS 语音输入键盘。它解决的核心问题是:市面上的语音听写服务大多依赖云端、需要订阅、且会把语音上传到第三方服务器,隐私和成本都不可控。Diction 让你把语音识别模型跑在自己的机器上,手机端通过键盘扩展把录音发到自托管后端,转成文字后直接插入输入框。技术上支持 Parakeet、Whisper 等 STT 模型,后端用 Go 实现,便于部署在个人服务器或 NAS 上。核心能力包括:iOS 自定义键盘集成、自托管推理服务、多模型可切换、端到端语音转文本流程。适合注重隐私、想摆脱订阅制、又愿意自己折腾服务器的用户。
whisper.cpp、Willow、VoiceInk
Diction 是语音识别领域的开源项目,由 DictionLabs 开发,是 2026 年新上线的项目。
它收录于语音识别分类,该分类目前共有 212 个项目,GitHub 星标数为 203。
项目目前处于活跃维护状态,最近一次代码更新于 2026-09-23。开源免费,自托管使用。
它主要面向的使用场景是:在iPhone任意App里用自托管键盘做私密语音输入。同类可对比的替代方案包括 whisper.cpp、Willow、VoiceInk。
上一篇:qwen-scribe
下一篇:open-wispr
obs-localvocal
开源
直播录屏时,本地AI实时生成字幕,保护隐私零延迟
OBS plugin for local speech recognition and captioning using AI
LiveCaptions-Translator
开源
实时捕获系统音频,一键翻译成你懂的语言
Lightweight and powerful real-time audio/speech translation tool based on Windows Li···
speechbrain
开源
一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务
A PyTorch-based Speech Toolkit
whisper-diarization
开源
给语音转写加上说话人标签,会议记录一目了然
Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper