vits

本站收录 29 个带「vits」标签的 AI 开源项目

GPT-SoVITS仅需 1 分钟语音数据即可训练出高质量 TTS 模型的少样本声音克隆方案。集成语音识别、文本转语音与声音转换能力,训练与推理全流程自动化,让个人也能轻松打造专属★ 62,247fish-speechfish-speech 是一个开源的文本转语音(TTS)模型,基于 VQGAN 和 Llama 架构,实现了目前最先进的语音合成效果。它解决了传统 TTS 系统★ 32,888sherpa-onnxsherpa-onnx 是一个基于下一代 Kaldi 和 ONNX Runtime 的语音处理工具包,专注于离线场景下的语音识别(ASR)、文本转语音(TTS)★ 15,039AmphionAmphion 是一个面向音频、音乐和语音生成的开源工具包,旨在支持可复现研究,并帮助初级研究者和工程师快速入门。它集成了多种主流模型与算法,涵盖文本到语音(T★ 10,305Bert-VITS2Bert-VITS2 是一个基于 VITS2 架构、引入多语言 BERT 特征的开源语音合成(TTS)项目。它解决了传统端到端 TTS 模型在多语言、多说话人场★ 8,805ApplioApplio 是一个专注于易用性和性能的语音转换工具,基于 PyTorch 实现,支持实时语音到语音转换(VC)、语音克隆和文本到语音(TTS)。它解决了传统语★ 3,770Genie-TTSGenie-TTS 是一个专注于 GPT-SoVITS 模型的 ONNX 推理引擎与模型转换工具。它解决了 GPT-SoVITS 模型在部署和推理时依赖复杂 P★ 1,785ChatWaifu_MobileChatWaifu_Mobile 是一个移动端的二次元 AI 伴侣聊天应用,基于 C++ 和 Android 技术栈构建。它解决了在手机上实现沉浸式虚拟角色交互★ 1,429vits_chinesevits_chinese 是一个基于 BERT 和 VITS 的中文语音合成(TTS)最佳实践项目,融合了微软自然语音的某些特性,并支持 ONNX 流式输出。它★ 1,228DragonianVoiceDragonianVoice 是一个基于 C++ 的歌声转换(SVC)和语音合成(TTS)推理库,旨在为生产环境提供高性能、低延迟的模型部署方案。它集成了多种主★ 1,130vits-simple-apivits-simple-api 是一个基于 Python 的轻量级 VITS 语音合成 HTTP 接口服务,通过扩展 Moegoe 项目实现。它解决了 VITS★ 1,049lora-svclora-svc 是一个基于 Whisper 和 LoRA 技术的歌声转换与克隆开源项目。它解决的核心问题是:如何用少量目标歌手的音频数据,快速克隆其音色并实现★ 646SummerTTSSummerTTS 是一个基于 C++ 的轻量级中英文语音合成(TTS)项目,主打独立编译和零依赖。它解决了传统 TTS 系统依赖复杂、部署困难的问题,用户只需★ 544rvc-webuirvc-webui 是 liujing04 对 Retrieval-based-Voice-Conversion-WebUI(RVC)的重构项目,旨在提供更易用★ 522AivisSpeechAivisSpeech 是一个基于 AI 的语音模仿与文本转语音(TTS)系统,专注于日语语音合成。它利用 Style-Bert-Vits2 等先进模型,能够通★ 482ultimate-rvcultimate-rvc 是一个基于检索式语音转换(RVC)的音频内容创作应用,主要用于生成歌曲翻唱和语音合成。它解决了普通用户难以训练和使用高质量语音模型的问★ 330piper-pluspiper-plus 是一个多语言神经语音合成(TTS)引擎,基于 VITS 模型并引入韵律增强,支持日语、英语、中文、西班牙语、法语、葡萄牙语等 6 种语言(★ 217Persian-tts-coquiPersian-tts-coqui 是一个面向波斯语/法尔西语的开源文本转语音(TTS)训练项目,基于 Coqui TTS 框架构建。它解决了波斯语语音合成领域★ 216AivisSpeech-EngineAivisSpeech-Engine 是一个基于 Python 的 AI 语音合成引擎,专注于日文文本到语音(TTS)转换,并支持声音模仿。它整合了 BERT-★ 181Bert-VITS2-MNNBert-VITS2-MNN 是一个面向 Android 移动端的离线语音合成运行时,基于阿里巴巴的 MNN 推理引擎,将 Bert-VITS2 模型轻量化部署★ 162GSV-TTS-LiteGSV-TTS-Lite 是一个专为 GPT-SoVITS 文本转语音模型设计的高性能推理引擎,专注于少样本语音克隆。它解决了 GPT-SoVITS 原始推理速★ 160euankaeuanka 是一个本地化部署的语音助手项目,旨在将完整的语音交互链路(ASR-NLP-LLM-TTS)全部运行在本地设备上,解决云端依赖带来的隐私和延迟问题。★ 152MB-iSTFT-VITS2MB-iSTFT-VITS2 是一个基于 PyTorch 的语音合成(TTS)开源项目,它将 MB-iSTFT-VITS 的组件应用到 vits2_pytorc★ 135VitsServerVitsServer 是一个基于 VITS 模型和 ONNX Runtime 的文本转语音(TTS)推理服务器,专为快速部署和低延迟合成而设计。它解决了 VIT★ 130vtbaivtbai 是一个面向虚拟主播(VTB)的 AI 直播辅助工具,主要解决 B 站直播中虚拟形象无法智能互动的问题。它基于 ChatGPT 后端,将观众弹幕转化为★ 112VITSVITS 是一个基于 PyTorch 的文本转语音(TTS)与语音转换(VC)工具,支持将文本合成为自然语音,并能将一个人的声音特征迁移到另一个人上。它解决了传★ 93PolyLangVITSPolyLangVITS 是一个基于 VITS 的多语言语音合成项目,支持韩语、日语、英语和中文四种语言。它利用 VITS 的端到端架构,将文本直接转换为语音,★ 75piper-rspiper-rs 是一个用 Rust 编写的 Piper 文本转语音(TTS)模型推理库。它解决了在 Rust 生态中缺少高质量、离线可用的神经网络语音合成方案★ 65VITS-PytorchVITS-Pytorch 是一个基于 PyTorch 的端到端语音合成(TTS)项目,实现了 VITS 模型。VITS 通过对抗训练和变分推断,直接从文本生成高★ 59