audio-diffusion

像画图一样生成音乐,给段描述就出专属旋律

利用 Hugging Face 的 diffusers 库将扩散模型应用于音乐合成,把图像生成领域的扩散技术迁移到音频,支持生成风格多样的音乐片段。是探索扩散模型在音频创作中应用的有趣实验项目。

开源 开源免费 音频音乐
GitHub 星标 ★ 793
维护状态 低维护
是否开源
定价模式 开源免费

项目数据

分类音频音乐
开发团队teticio
所属国家
官网地址
定价模式开源免费
价格区间
是否开源
开源协议GPL-3.0
主要语言Jupyter Notebook
技术栈/模型diffusion-models,huggingface,latent-diffusion,music-generation
GitHub 星标★ 793
30天Star增速
HF 下载量
上线时间2022-08-07 00:00:00
最近更新2026-07-31 00:00:00
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数1

核心亮点

    不足之处

      适用场景

        替代项目

        项目介绍

        利用 Hugging Face 的 diffusers 库将扩散模型应用于音乐合成,把图像生成领域的扩散技术迁移到音频,支持生成风格多样的音乐片段。是探索扩散模型在音频创作中应用的有趣实验项目。。主要使用 Jupyter Notebook 开发,GitHub 星标 793。

        上一篇:MidiTok

        下一篇:open-webui-tools

        同类项目推荐

        StyleTTS2 开源

        音色情绪几乎以假乱真,听不出是机器在读

        StyleTTS 2: Towards Human-Level Text-to-Speech through Style Diffusion and Adversari···

        ★ 6328 2026-08-09
        tuneflow-py 开源

        编曲软件里直接跑 AI,灵感落地不用切工具

        + Build your music algorithms and AI models with the next-gen DAW

        ★ 890 2026-08-09
        alda-clj 开源

        A Clojure library for live-coding music with Alda

        ★ 70 2026-08-09