english

本站收录 19 个带「english」标签的 AI 开源项目

ChatTTS专为日常对话场景设计的生成式语音模型,能够生成自然流畅、富有表现力的对话语音。支持细粒度韵律与情感控制,中文合成效果出色,广泛应用于对话系统、有声内容创作与 A★ 39,879CosyVoice阿里通义实验室开源的多语言大规模语音生成模型,提供推理、训练与部署全栈能力。支持零样本语音克隆与跨语种语音合成,音色自然流畅,是构建语音助手、智能配音与内容创作★ 23,810ebook2audiobookebook2audiobook 是一个将电子书自动转换为有声书的开源工具,支持 EPUB、PDF 等格式,内置 1158 多种语言和声音克隆功能。它解决了传统有★ 20,249read-frog陪读蛙(Read Frog)是一个基于TypeScript构建的开源语言学习与翻译工具,旨在通过沉浸式阅读帮助用户提升外语能力。它解决了传统语言学习软件缺乏真实★ 9,925MeloTTSMyShell.ai 开源的高质量多语言 TTS 库,支持英语、西班牙语、法语、中文、日语、韩语六种语言。合成速度快、音质自然,支持本地部署与批量推理,适合多语★ 7,650MOSS-TTS-NanoMOSS-TTS-Nano 是 MOSI.AI 与 OpenMOSS 团队开源的多语言轻量级语音合成模型,参数量仅 0.1B,专为实时语音生成设计。它解决了传统★ 4,428RHVoiceRHVoice 是一款免费开源的语音合成器,主要面向俄语及其他多种语言。它解决的是文本转语音(TTS)的需求,尤其擅长俄语,同时支持英语、巴西葡萄牙语、世界语、★ 1,844Speech-AI-ForgeSpeech-AI-Forge 是一个围绕 TTS(文本转语音)生成模型构建的开源项目,提供 API 服务器和基于 Gradio 的 WebUI。它整合了多种主★ 1,420KnowLMKnowLM 是一个开源的知识增强大语言模型框架,旨在提升大模型在知识密集型任务上的表现。它通过整合外部知识库、知识图谱和结构化数据,在预训练、微调和推理阶段注★ 1,386dictionariezdictionariez 是一款可高度定制的浏览器词典扩展,支持在网页中双击查词,覆盖 20 多种语言、1000 多部词典,并提供文本转语音、翻译和 Anki ★ 674FCH-TTSFCH-TTS 是一个快速文本转语音(TTS)模型,基于 Python 实现,支持英语、中文、日语、韩语、俄语和藏语六种语言。它旨在解决传统 TTS 模型推理速★ 281CrowniclesCrownicles 是一个基于文本的冒险游戏,以 Discord 机器人的形式运行。它解决了在聊天平台上缺乏沉浸式互动叙事体验的问题,让用户通过发送指令在 D★ 259DiffSingerDiffSinger 是一个基于 PyTorch 的开源歌声合成(Singing Voice Synthesis)项目,核心思想是将浅层扩散机制(Shallow★ 247IEPileIEPile是一个大规模信息抽取语料库,由浙江大学等机构在ACL 2024发布。它收集并清洗了来自多个公开数据源的约2000万条信息抽取样本,覆盖实体识别、关系★ 213StyleSpeechStyleSpeech 是 Meta-StyleSpeech 的 PyTorch 非官方实现,旨在解决多说话人自适应文本转语音(TTS)中需要大量参考音频的问题★ 198Parallel-Tacotron2Parallel-Tacotron2 是 Google Parallel Tacotron 2 的 PyTorch 非官方实现,旨在解决传统自回归 TTS 模型★ 191napolabNapolab 是一个专注于葡萄牙语自然语言处理的基准测试项目,旨在系统评估和追踪葡萄牙语语言模型的最新进展。它通过精心策划的葡萄牙语任务集,为研究者、开发者和★ 72ncnn-android-piperncnn-android-piper 是一个基于 ncnn 推理框架的本地神经网络语音合成(TTS)引擎,专为 Android 和 iOS 移动端设计。它解决了★ 69Daft-ExprtDaft-Exprt 是一个基于 PyTorch 的非自回归语音合成模型,专注于跨说话人的韵律迁移,旨在解决 expressive TTS 中韵律风格难以从源说★ 55