CosyVoice

输入文字就能生成多语种配音,一天的工作十分钟搞定

阿里通义实验室开源的多语言大规模语音生成模型,提供推理、训练与部署全栈能力。支持零样本语音克隆与跨语种语音合成,音色自然流畅,是构建语音助手、智能配音与内容创作应用的理想基座。

开源 开源免费 对话助手
GitHub 星标 ★ 22659
维护状态 维护中
是否开源
定价模式 开源免费

项目数据

分类对话助手
开发团队QwenAudio
所属国家
定价模式开源免费
价格区间
是否开源
开源协议Apache-2.0
主要语言Python
技术栈/模型audio-generation,cantonese,chatbot,chatgpt,chinese,cosyvoice,cross-lingual,english,fine-grained,fine-tuning,gpt-4o,japanese,korean,multi-lingual,natural-language-generation,python,text-to-speech,tts,voice-cloning
GitHub 星标★ 22659
30天Star增速
HF 下载量
上线时间2024-07-03 00:00:00
最近更新2026-08-09 00:00:00
维护状态维护中
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数1

核心亮点

    不足之处

      适用场景

        替代项目

        项目介绍

        阿里通义实验室开源的多语言大规模语音生成模型,提供推理、训练与部署全栈能力。支持零样本语音克隆与跨语种语音合成,音色自然流畅,是构建语音助手、智能配音与内容创作应用的理想基座。。主要使用 Python 开发,GitHub 星标 22648。

        上一篇:没有了!

        下一篇:GPT-SoVITS

        同类项目推荐

        StyleTTS2 开源

        音色情绪几乎以假乱真,听不出是机器在读

        StyleTTS 2: Towards Human-Level Text-to-Speech through Style Diffusion and Adversari···

        ★ 6328 2026-08-09
        tuneflow-py 开源

        编曲软件里直接跑 AI,灵感落地不用切工具

        + Build your music algorithms and AI models with the next-gen DAW

        ★ 890 2026-08-09
        NeuroRVQ 开源

        NeuroRVQ: Multi-Scale Biosignal Tokenization for Generative Foundation Models

        ★ 51 2026-08-09
        voc2vec 开源

        This repository contains the code for the paper "voc2vec: A Foundation Model for Non···

        ★ 58 2026-08-09