music
本站收录 56 个带「music」标签的 AI 开源项目(按 GitHub 星标从高到低,此处展示前 50 个)
AudioGPTAudioGPT 是一个多模态音频处理框架,旨在统一理解和生成语音、音乐、声音以及说话头(Talking Head)等音频相关任务。它解决了传统音频模型功能单一★ 10,169
Red-DiscordBotRed-DiscordBot 是一个功能丰富的 Discord 机器人框架,基于 Python 构建,采用模块化插件架构。它解决了 Discord 服务器管理、★ 5,715
ace-step-ui开源免费的 ACE-Step 1.5 AI 音乐生成专业界面,被誉为 Suno 的最佳开源替代。本地运行、无限生成、无需付费,提供专业级的音乐创作体验,帮助用户★ 4,991
riffusion-hobbyriffusion-hobby 是一个基于 Stable Diffusion 的音乐生成开源项目,将图像生成技术应用于音频频谱图,实现实时音乐创作。它解决了传统★ 3,900
TTS-WebUITTS-WebUI 是一个集成了多种主流语音与音频生成模型的一站式 Web 界面,基于 Gradio 和 React 构建。它解决了用户在不同 TTS、语音克隆★ 3,276
ableton-mcpableton-mcp 是一个开源项目,它通过模型上下文协议(MCP)将 Ableton Live 数字音频工作站与 Claude AI 连接起来。该项目解决了★ 3,120
AudioMuse-AIAudioMuse-AI 是一个开源的智能音乐分析引擎,专注于解决音乐库中“有歌却难找”的痛点。它通过声学分析技术,不依赖任何元数据或外部服务,直接对音频文件进★ 2,672
riffusion-app-hobbyriffusion-app-hobby 是一个基于 Stable Diffusion 的实时音乐生成 Web 应用,将图像生成模型应用于音频频谱图,实现从文本或★ 2,670
museganMuseGAN 是一个基于生成对抗网络的音乐生成模型,可生成多轨、多乐器协同的复调音乐,支持钢琴曲与完整多轨作品的创作。为 AI 音乐生成研究提供了经典的基线方★ 2,045
generative.fmgenerative.fm 是一个在浏览器中播放生成式音乐的平台。它解决了传统音乐播放器只能播放固定曲目的问题,让用户能够体验由算法实时生成、永不重复的音乐。其★ 1,588
SALMONNSALMONN 是一个先进的多模态大语言模型(LLM)家族,由清华团队开发,旨在让机器能够同时理解和处理语音、音频、音乐、视频等多种模态信息。它解决了传统模型只★ 1,538
MusicGPTMusicGPT 是一个基于 Rust 的本地音乐生成工具,它利用本地运行的大语言模型(LLM)理解自然语言提示,并生成对应的音乐。该项目解决了在无网络、隐私敏★ 1,459
audio-webuiaudio-webui 是一个面向音频相关神经网络的统一 Web 界面,旨在解决音频 AI 工具分散、使用门槛高的问题。它集成了多种主流音频生成与处理模型,如 ★ 1,243
MidiTok专为深度学习模型设计的 MIDI 与符号音乐分词器,提供多种 tokenization 策略,可将符号音乐高效转换为模型可读的序列。是音乐生成、音乐理解等深度学★ 899
tuneflow-py将 AI 与音乐算法带入下一代 DAW 的 Python 工具包,支持在数字音频工作站中直接构建音乐算法与 AI 模型。为音乐技术开发者提供打通研究、开发与创作★ 897
linuxwavelinuxwave 是一个用 Zig 语言编写的命令行工具,它从 Linux 系统的熵源(如 /dev/urandom)中读取随机数据,并将其转换为音乐。项目的★ 665
LLM-HubLLM-Hub 是一个本地 AI 助手,专注于图像生成领域,但实际覆盖多模态能力。它基于 C++ 构建,集成多种主流大语言模型(如 Gemma、Llama、Mi★ 601
JJazzLabJJazzLab 是一款开源的自动伴奏生成应用,专为音乐人、练习者和即兴演奏者设计。它解决了在没有真实乐队的情况下,如何快速获得高质量伴奏音乐的问题。用户只需输★ 594
musical-neural-netmusical-neural-net 是一个用 LSTM 循环神经网络训练生成钢琴或小提琴/钢琴合奏音乐的早期开源项目。它解决的核心问题是:如何让机器学会模仿特★ 567
GTSingerGTSinger 是一个面向歌唱语音合成研究的全球多技术歌唱语料库,由 NeurIPS 2024 Spotlight 论文提出。它解决了现有歌唱数据集在技术覆盖★ 529
muspyMusPy 是一个用于符号音乐生成的开源 Python 工具包,旨在为音乐生成研究和应用提供统一、高效的基础设施。它解决了音乐生成领域中数据格式混乱、数据集不兼★ 525
Awesome-Singing-Voice-Synthesis-and-Singing-Voice-Conversion这是一个关于歌声合成(SVS)与歌声转换(SVC)的精选论文与项目列表,同时涵盖语音合成(TTS)、语音转换(VC)及相关领域(如音乐合成、自动音乐转录、MOS★ 494
audio-development-toolsAudio Development Tools (ADT) 是一个面向音频技术研发的开源项目,旨在整合声音、语音和音乐领域的开发工具链。它解决音频开发者缺乏统一★ 469
skillsskills 是 ElevenLabs 官方维护的技能集合库,旨在为 AI 智能体开发提供即插即用的音频相关能力。它解决了开发者在构建语音交互应用时,需要从零实★ 462
POP909-DatasetPOP909-Dataset 是一个面向流行音乐编曲生成研究的开源数据集,由上海交通大学缪斯实验室发布,对应论文《POP909: A Pop-song Data★ 410
vampnetvampnet 是一个基于掩码变换器(masked transformer)的音频音乐生成开源项目。它解决的是音乐生成中可控性与生成质量平衡的问题,核心能力在于★ 357
xcodecxcodec 是一个面向音频语言模型的语义编解码器,由香港科技大学等机构在 AAAI 2025 提出。它针对传统音频编解码器(如 EnCodec)在语义信息保留★ 316
Tegridy-MIDI-DatasetTegridy-MIDI-Dataset 是一个用于音乐 AI 模型训练的高质量 MIDI 数据集项目。它解决了音乐生成、转录等任务中缺乏干净、结构化 MIDI★ 296
MOSS-Audio-TokenizerMOSS-Audio-Tokenizer 是一个基于因果 Transformer 架构(CAT)的音频分词器,旨在将连续音频信号转换为离散 token,为音频语★ 258
KarmaBotKarmaBot 是一个多功能的 Discord 机器人,为服务器提供音乐播放和实用工具命令,已被超过 20 万用户使用。它基于 discord.js 开发,使★ 254
blossomBlossom 是一个基于 JavaScript 的交互式音乐生成器,旨在让用户通过直观的图形界面轻松创作旋律。它解决了音乐创作门槛高的问题,无需乐理知识即可通★ 248
Los-Angeles-Music-ComposerLos-Angeles-Music-Composer 是一个基于局部窗口注意力的多乐器音乐生成 Transformer 模型,专注于有监督的音乐生成任务。它解决★ 242
musicaizmusicaiz 是一个面向符号音乐生成、评估与分析的 Python 框架。它解决了音乐研究者与开发者在构建音乐生成模型时缺乏统一工具链的问题,提供从数据加载、★ 193
audiocraft-infinity-webuiaudiocraft-infinity-webui 是一个为 Meta 的 AudioCraft 音频生成模型打造的无限时长音频生成 Web 界面。它解决了 A★ 170
Awesome-Music-GenerationAwesome-Music-Generation 是一个聚焦音乐生成模型(MG²)的资源合集,收录了基于扩散模型、大语言模型等技术的音乐生成项目、论文和工具。它★ 167
mmtmmt 是论文《Multitrack Music Transformer》(ICASSP 2023)的官方实现,一个基于 Transformer 的多轨音乐生成★ 155
KaraFanKaraFan 是一个基于人工智能的音乐分离开源项目,旨在从混合音频中提取人声和伴奏,尤其适用于卡拉OK伴奏制作。它利用深度学习模型对音频信号进行源分离,核心能★ 151
awesome-music-programming这是一个精心整理的音频与音乐编程资源清单,收录了音乐编程语言、库、框架和工具。它解决了音乐开发者或爱好者寻找合适编程工具时信息分散、难以比较的问题。项目以分类列★ 150
pypianorollpypianoroll 是一个用于处理钢琴卷帘(piano roll)格式音乐数据的 Python 工具包。它解决了音乐信息检索和生成任务中,钢琴卷帘数据格式不★ 148
ThemeTransformerThemeTransformer 是一个基于主题的音乐生成开源项目,是 IEEE TMM 论文的官方实现。它解决的核心问题是:如何让 AI 根据用户给定的主题(★ 127
neoscoreneoscore 是一个基于 Python 的音乐记谱库,采用图形优先(graphics-first)的范式,将音乐符号视为可自由定位的图形对象,而非传统乐谱软★ 122
tegridy-toolstegridy-tools 是一个面向符号音乐(MIDI)的 NLP 与人工智能工具包,旨在用自然语言处理技术处理音乐序列数据。它解决了传统音乐生成模型难以处理★ 117
facetfacet 是一个基于 NodeJS 和浏览器的实时编码与合成工具,专为生成艺术和算法创作设计。它让用户通过编写 JavaScript 代码,在浏览器中实时生成★ 111
libpd-rslibpd-rs 是一个为 Rust 语言提供 libpd 安全绑定的开源库。libpd 是 Pure Data(Pd)音频编程语言的嵌入式库,允许开发者将 P★ 104
infinite_gnossienneinfinite_gnossienne 是一个用 JavaScript 实现的生成式音乐项目,它基于 Erik Satie 的经典钢琴曲《Gnossiennes★ 103
BeatDropBeatDrop 是一个基于 C++ 开发的音乐可视化工具,专注于将音频输入实时转化为动态视觉效果。它解决了音乐播放时缺乏沉浸式视觉反馈的问题,通过分析音频频谱★ 94
SuperPianoSuperPiano 是一个基于 Jupyter Notebook 的开源项目,专注于音乐 AI 模型的训练与音乐生成。它利用 Google 的 Transfo★ 91
lakh-pianoroll-datasetlakh-pianoroll-dataset 是一个包含 174,154 个多轨钢琴卷帘(piano-roll)的开源数据集,基于 Lakh MIDI 数据集处★ 87
ismir2019tutorial这是一个用于ISMIR 2019教程的配套网站,教程主题为“用GAN生成音乐:概述与案例研究”。该项目旨在为音乐生成领域的研究者和开发者提供系统性的学习资源,涵★ 84