so-vits-models

一站式收藏AI模型,快速找到声音、图像、视频生成工具

这是一个收集AI模型与应用的资源汇总项目,聚焦于声音、图像、视频和文本生成领域。它整理了so-vits-svc(歌声转换)、TTS(文本转语音)、Stable Diffusion(图像生成)、LLM(大语言模型)以及SadTalker(数字人)等热门开源模型的资料、链接和应用示例,旨在为开发者和爱好者提供一个快速查找和了解相关AI工具的入口。项目解决的是AI模型分散、难以发现和选择的问题,核心能力是分类整理和索引,帮助用户节省搜索时间,快速定位所需技术。

开源 free 图像生成
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 210
维护状态 低维护
是否开源
定价模式 free

项目数据

分类图像生成
开发团队sekift
所属国家
官网地址
定价模式free
价格说明开源项目,收集各类模型与应用,全部免费,需自行部署使用。
访问状态
是否开源
开源协议MIT
主要语言
技术栈/模型ai,audio,chatgpt,deeplearning,llm,sadtalker,so-vits-svc,stable-diffusion,tts
GitHub 星标★ 210
30天Star增速
HF 下载量
上线时间2023-07-20 00:00:00
最近更新2026-09-15 00:00:00
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数3

使用教程

核心亮点

  • 覆盖so-vits-svc、TTS、SD、LLM等主流AI方向,分类清晰,便于检索
  • 提供模型应用示例和链接,降低上手门槛,适合新手入门
  • 紧跟社区热点,整合SadTalker等新兴数字人技术,实用性强

不足之处

  • 项目以资源列表为主,缺乏原创代码或深度教程,内容深度有限
  • 文档/社区待观察

适用场景

  • AI爱好者快速发现和试用各类生成模型
  • 开发者寻找特定任务(如歌声转换、数字人)的开源实现
  • 初学者了解AI应用生态,选择学习方向

替代项目

Awesome-LLM、Awesome-Stable-Diffusion、Awesome-TTS

项目介绍

so-vits-models 是音频音乐领域的开源项目,由 sekift 开发,2023 年首次发布。

它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 210。

项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-15。收集各类模型与应用,全部免费,需自行部署使用。

它主要面向的使用场景是:AI爱好者快速发现和试用各类生成模型。同类可对比的替代方案包括 Awesome-LLM、Awesome-Stable-Diffusion、Awesome-TTS。

同类项目推荐

tango 开源

输入一句话,自动生成匹配的音频内容

A family of diffusion models for text-to-audio generation.

★ 1239 2026-08-09
AuK 开源

一个模型搞定语音生成、编辑与分离

AuK: An Open-Source Foundational Model for Speech Generation and Editing

★ 1236 2026-09-13
swift-tts 开源

Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine

A straightforward package containing version for Swift modern concurrency, Point-Fre···

★ 52 2026-08-09
ai-dj 开源

现场演出中实时用 AI 生成音乐,保持人类掌控

AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···

★ 245 2026-08-09