mimiuchi

在 VR 里动嘴就能打字,语音秒变文字发给任意应用

mimiuchi 是一个免费、可定制、支持 OSC 的语音转文字界面,旨在将语音识别结果实时转发到不同类型的应用程序,尤其针对 VR 聊天等虚拟现实场景。它解决的是在虚拟世界或跨应用中难以高效输入文字的问题,通过语音输入替代键盘,并将文本通过 OSC 协议发送到目标应用。核心能力包括:基于浏览器的语音识别(STT),支持多语言翻译,可将识别文本翻译成其他语言;内置文本转语音(TTS)功能,可朗读识别内容;高度可定制的界面,基于 Vue 和 Vuetify 构建,用户可调整布局和样式;通过 OSC 协议与外部应用(如 VRChat)无缝集成,实现实时文本传输。项目处于早期阶段,但功能架构清晰,适合 VR 社交、直播辅助、无障碍输入等场景。

开源 free 音频音乐
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 63
维护状态 低维护
是否开源
定价模式 free

项目数据

分类音频音乐
开发团队naeruru
所属国家
定价模式free
价格说明完全免费的开源语音转文字界面,支持自定义和OSC,可在线使用。
访问状态
是否开源
开源协议GPL-3.0
主要语言TypeScript
技术栈/模型osc,speech-to-text,stt,translations,tts,vrchat,vue,vuetify
GitHub 星标★ 63
30天Star增速
HF 下载量
上线时间2022-09-01 00:00:00
最近更新2026-07-08 00:00:00
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数3

使用教程

核心亮点

  • 支持 OSC 协议,可直接对接 VRChat 等 VR 应用,实现语音输入实时上屏
  • 集成翻译功能,语音识别后可自动翻译成多语言,方便跨语言交流
  • 内置 TTS 朗读,识别文本可语音播报,增强反馈

不足之处

  • 项目处于早期,星标仅 63,功能稳定性和社区支持待观察
  • 依赖浏览器语音识别,对网络和浏览器兼容性有要求
  • 文档和示例较少,上手需要一定技术背景

适用场景

  • VR 社交(如 VRChat)中语音输入文字聊天
  • 直播时语音转文字显示在 OBS 或聊天窗口
  • 无障碍场景,帮助行动不便者用语音输入文字

替代项目

Vosk、Whisper、SpeechRecognition

项目介绍

mimiuchi 是语音识别领域的开源项目,由 naeruru 开发,2022 年首次发布。

它收录于语音识别分类,该分类目前共有 212 个项目,GitHub 星标数为 63。

项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-07-08。完全免费的开源语音转文字界面,支持自定义和OSC,可在线使用。从国内网络环境看,可直接访问。

它主要面向的使用场景是:VR社交(如VRChat)中语音输入文字聊天。同类可对比的替代方案包括 Vosk、Whisper、SpeechRecognition。

上一篇:go-speech

下一篇:pinyin-to-ipa

同类项目推荐

obs-localvocal 开源

直播录屏时,本地AI实时生成字幕,保护隐私零延迟

OBS plugin for local speech recognition and captioning using AI

★ 1616 2026-09-10
LiveCaptions-Translator 开源

实时捕获系统音频,一键翻译成你懂的语言

Lightweight and powerful real-time audio/speech translation tool based on Windows Li···

★ 3755 2026-08-10
speechbrain 开源

一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务

A PyTorch-based Speech Toolkit

★ 11834 2026-08-26
whisper-diarization 开源

给语音转写加上说话人标签,会议记录一目了然

Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper

★ 5657 2026-08-13