mlp-singer 是音频音乐领域的开源项目,由 neosapience 开发,2021 年首次发布。
它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 118。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2025-12-08。MIT许可证,完全免费,需自行部署使用。
它主要面向的使用场景是:研究歌声合成快速推理方法,作为基线模型对比。同类可对比的替代方案包括 DiffSinger、VISinger2、NeuralSV。

用纯MLP快速合成韩语歌声,告别慢速自回归。
MLP Singer 是一个基于多层感知机(MLP)的韩语歌声合成(Singing Voice Synthesis)开源项目,对应论文发表于 IEEE MLSP 2021。它旨在解决传统歌声合成中自回归模型推理速度慢、并行化困难的问题,通过纯 MLP 架构实现快速并行合成。项目提供完整的训练和推理代码,支持从文本/乐谱到歌声的端到端生成。核心能力包括:利用 MLP 替代 RNN/Transformer 等复杂结构,显著提升合成速度;支持韩语歌声合成,可生成带音高和节奏控制的歌唱音频;代码基于 PyTorch,易于复现和二次开发。对于研究歌声合成或希望快速构建轻量级合成系统的开发者,该项目提供了一个简洁高效的基线方案。
DiffSinger、VISinger2、NeuralSV
mlp-singer 是音频音乐领域的开源项目,由 neosapience 开发,2021 年首次发布。
它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 118。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2025-12-08。MIT许可证,完全免费,需自行部署使用。
它主要面向的使用场景是:研究歌声合成快速推理方法,作为基线模型对比。同类可对比的替代方案包括 DiffSinger、VISinger2、NeuralSV。
上一篇:phoenix10.1
下一篇:tiktok-tts
tango
开源
输入一句话,自动生成匹配的音频内容
A family of diffusion models for text-to-audio generation.
AuK
开源
一个模型搞定语音生成、编辑与分离
AuK: An Open-Source Foundational Model for Speech Generation and Editing
swift-tts
开源
Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine
A straightforward package containing version for Swift modern concurrency, Point-Fre···
ai-dj
开源
现场演出中实时用 AI 生成音乐,保持人类掌控
AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···