ai-audio-datasets 是数据集领域的开源项目,由 Yuan-ManX 开发,2022 年首次发布。
在全站 13,090 个收录项目中,它的 GitHub 星标数(968)位列前 30%,在数据集分类中处于中上游。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-22。开源数据集列表,MIT 许可证,完全免费,无付费版本。
它主要面向的使用场景是:训练语音识别、语音合成或声音克隆模型。同类可对比的替代方案包括 Awesome-Audio-Datasets、AudioSet、Common Voice。




