Applio

一键上传音频,轻松实现声音克隆与转换

Applio 是一个专注于易用性和性能的语音转换工具,基于 PyTorch 实现,支持实时语音到语音转换(VC)、语音克隆和文本到语音(TTS)。它解决了传统语音转换模型配置复杂、使用门槛高的问题,提供了简洁的图形界面和命令行接口,让用户无需深入技术细节即可完成声音转换。核心能力包括高质量的音色转换、多模型支持(如 RVC、VITS)、实时处理以及批量音频转换。项目采用模块化设计,便于扩展和集成,适合个人开发者、内容创作者和研究者使用。

开源 free 音频音乐
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 3746
维护状态 活跃
是否开源
定价模式 free

项目数据

分类音频音乐
开发团队IAHispano
所属国家
官网地址https://applio.org
定价模式free
价格说明开源项目,MIT许可证,完全免费,可自行部署或使用在线服务。
访问状态
是否开源
开源协议MIT
主要语言Python
技术栈/模型ai,applio,pytorch,rvc,speech,speech-to-speech,text-to-speech,tts,vc,vits,voice,voice-clone,voice-cloning,voice-conversion
GitHub 星标★ 3746
30天Star增速
HF 下载量
上线时间2023-08-07 00:00:00
最近更新2026-09-23 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数5

使用教程

难度:入门 约 10 分钟 部署方式:本地安装 6 步

环境要求

  • Windows 或 Linux/macOS 操作系统
  • 已安装 Python 运行环境(项目基于 Python 与 PyTorch)
  • 能够访问 GitHub 与项目官网 docs.applio.org
  • 若使用命令行方式,需已安装 git

安装与启动步骤

  1. 1下载项目文件

    从 GitHub 克隆官方仓库到本地,得到 run-install、run-applio 等脚本文件。

    git clone https://github.com/IAHispano/Applio.git
    cd Applio
  2. 2Windows 安装依赖

    在项目根目录双击 run-install.bat,脚本会自动完成环境与依赖安装,请耐心等待。

    .
    un-install.bat
  3. 3Linux/macOS 装依赖

    在项目根目录执行 run-install.sh 完成安装;若提示无权限,可先给脚本加执行权限。

    ./run-install.sh
  4. 4Windows 启动

    安装完成后双击 run-applio.bat 启动,会自动在默认浏览器中打开 Gradio 界面。

    .
    un-applio.bat
  5. 5Linux/macOS 启动

    安装完成后执行 run-applio.sh 启动,同样会自动打开浏览器中的 Gradio 界面。

    ./run-applio.sh
  6. 6免安装体验

    不想本地部署可用官方 Colab 笔记本(含 UI 与 No UI 两版),或直接访问在线 Playground。

    https://colab.research.google.com/github/iahispano/applio/blob/main/assets/Applio.ipynb

如何确认成功

脚本运行后默认浏览器自动打开 Gradio 界面,即表示 Applio 启动成功。

常见问题

Q:Windows 上该怎么安装和启动?

A:在项目根目录先双击 run-install.bat 完成安装,再双击 run-applio.bat 启动,浏览器会自动打开 Gradio 界面。

Q:Linux/macOS 上怎么操作?

A:在项目根目录执行 run-install.sh 安装,然后执行 run-applio.sh 启动;两个脚本分别对应 Windows 的 bat 文件。

Q:不想本地安装可以吗?

A:可以。README 提供了 Google Colab 版本(带 UI 和不带 UI 两种)以及官网在线 Playground,无需本地安装即可体验。

Q:Applio 能商用吗?

A:可以商用,但需遵守 MIT 许可与项目 Terms of Use,确保拥有相应版权与授权,官方建议商用前联系 support@applio.org。

Q:项目还会持续更新吗?

A:官方说明 Applio 不再频繁更新,后续主要进行安全补丁、依赖更新和少量功能改进,因为项目已稳定成熟。

注意事项

  • README 只给出脚本名,未标注具体 Python 版本、依赖列表和端口,遇到报错请以 run-install 脚本输出与官方文档 docs.applio.org 为准。
  • 使用官方版本还需遵守仓库中的 TERMS_OF_USE.md,用于合法合规场景。
  • 生成的音频必须符合当地版权法律,不得侵犯他人知识产权与隐私权。
  • 官方 Colab 笔记本有 Applio.ipynb(含 UI)与 Applio_NoUI.ipynb(无 UI)两个入口。

核心亮点

  • 提供直观的图形界面,降低使用门槛,无需编程即可上手
  • 支持多种主流模型(RVC、VITS),转换音质高且延迟低
  • 模块化架构,便于二次开发和集成到其他应用

不足之处

  • 依赖较多,安装配置可能稍显复杂
  • 文档/社区待观察

适用场景

  • 内容创作者进行声音模仿或角色配音
  • 开发者集成语音转换功能到游戏或社交应用
  • 研究人员快速测试不同语音转换模型效果

替代项目

RVC (Retrieval-based Voice Conversion)、so-vits-svc、Coqui TTS

项目介绍

Applio 是音频音乐领域的开源项目,由 IAHispano 开发,2023 年首次发布。

在全站 13,014 个收录项目中,它的 GitHub 星标数(3,746)位列前 30%,在音频音乐分类的 738 个项目里位列前 7%。

近 45 天,它的 GitHub 星标从 3,569 增加到 3,746,净增 177。

项目目前处于活跃维护状态,最近一次代码更新于 2026-09-23。MIT许可证,完全免费,可自行部署或使用在线服务。从国内网络环境看,可直接访问。

它主要面向的使用场景是:内容创作者进行声音模仿或角色配音。同类可对比的替代方案包括 RVC (Retrieval-based Voice Conversion)、so-vits-svc、Coqui TTS。

上一篇:MOSS-TTS

下一篇:TTS-WebUI

同类项目推荐

tango 开源

输入一句话,自动生成匹配的音频内容

A family of diffusion models for text-to-audio generation.

★ 1239 2026-08-09
AuK 开源

一个模型搞定语音生成、编辑与分离

AuK: An Open-Source Foundational Model for Speech Generation and Editing

★ 1236 2026-09-13
swift-tts 开源

Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine

A straightforward package containing version for Swift modern concurrency, Point-Fre···

★ 52 2026-08-09
ai-dj 开源

现场演出中实时用 AI 生成音乐,保持人类掌控

AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···

★ 245 2026-08-09