music-generation

本站收录 108 个带「music-generation」标签的 AI 开源项目(按 GitHub 星标从高到低,此处展示前 50 个)

YuEYuE 是开源的全曲目音乐生成基础模型,功能类似 Suno.ai 但完全开放。支持生成带人声的完整歌曲,涵盖歌词、旋律与编曲,为音乐创作者提供可本地部署、可自由★ 10,578AmphionAmphion 是一个面向音频、音乐和语音生成的开源工具包,旨在支持可复现研究,并帮助初级研究者和工程师快速入门。它集成了多种主流模型与算法,涵盖文本到语音(T★ 10,305introtodeeplearningMIT 6.S191《深度学习导论》课程的官方实验材料,包含一系列Jupyter Notebook教程,覆盖深度学习基础、计算机视觉、自然语言处理、生成模型等核★ 8,822ace-step-ui开源免费的 ACE-Step 1.5 AI 音乐生成专业界面,被誉为 Suno 的最佳开源替代。本地运行、无限生成、无需付费,提供专业级的音乐创作体验,帮助用户★ 4,991audio.cppaudio.cpp 是一个基于 ggml 的纯 C++ 音频模型推理引擎,旨在为音频 AI 应用提供一体化、高性能的本地推理解决方案。它解决了传统音频 AI 工★ 3,180museganMuseGAN 是一个基于生成对抗网络的音乐生成模型,可生成多轨、多乐器协同的复调音乐,支持钢琴曲与完整多轨作品的创作。为 AI 音乐生成研究提供了经典的基线方★ 2,045sglang-omniSGLang-Omni 是一个基于 SGLang 的高性能多模态推理服务框架,专注于语音相关模型(TTS、ASR)及全模态(omni)模型的部署。它解决了传统语★ 1,302ai-audio-datasets覆盖语音、音乐与音效的 AI 音频数据集合集,为生成式 AI、AIGC、模型训练与智能音频工具开发提供高质量训练数据,是构建音频 AI 应用、开展相关研究的实用★ 970audio-ai-hub音频 AI 研究一站式导航,系统汇集论文、开源模型、基准测试与数据集,覆盖音频大模型、语音识别、TTS、音乐与音频生成等领域,是音频 AI 研究者与工程师快速了★ 960MidiTok专为深度学习模型设计的 MIDI 与符号音乐分词器,提供多种 tokenization 策略,可将符号音乐高效转换为模型可读的序列。是音乐生成、音乐理解等深度学★ 899tuneflow-py将 AI 与音乐算法带入下一代 DAW 的 Python 工具包,支持在数字音频工作站中直接构建音乐算法与 AI 模型。为音乐技术开发者提供打通研究、开发与创作★ 897AnyGPTAnyGPT 是一个基于离散序列建模的统一多模态大语言模型,旨在实现任意模态之间的相互转换与理解。它解决了传统多模态模型通常只支持文本与其他单一模态(如图像或语★ 883BoxBox 是 Android 平台上目前最先进的全离线客户端 AI 套件,基于 Kotlin 开发。它解决的是移动端 AI 应用过度依赖云端、隐私泄露和网络受限的★ 880open-webui-tools专为 Open WebUI 打造的模块化工具集,提供 15 余种专业工具、函数管道与过滤器,可将 Open WebUI 升级为强大的 AI 工作站。支持学术研究★ 819genmusic_demo_list这是一个自动音乐生成研究领域的演示网站列表,收录了众多相关项目的在线Demo入口。它解决的是研究人员和爱好者难以快速找到可用音乐生成演示的问题,将分散在各处的项★ 799audio-diffusion利用 Hugging Face 的 diffusers 库将扩散模型应用于音乐合成,把图像生成领域的扩散技术迁移到音频,支持生成风格多样的音乐片段。是探索扩散模★ 794music-generation-with-DL这是一个关于使用深度学习进行音乐生成的资源列表,汇集了论文、代码、数据集和工具,旨在帮助研究者和开发者快速了解该领域的研究进展和技术路线。项目按生成方法(如符号★ 729linuxwavelinuxwave 是一个用 Zig 语言编写的命令行工具,它从 Linux 系统的熵源(如 /dev/urandom)中读取随机数据,并将其转换为音乐。项目的★ 665MaestroMaestro 是一个 100% 本地运行的一站式 AI 视频、图像和音乐创作工作室,基于 WanGP 管线构建,通过 Pinokio 一键安装。它解决的是本地★ 640OpenMusicOpenMusic 是一个基于 Python 的文本生成音乐(Text-to-Music)开源项目,旨在实现当前最先进的(SOTA)音乐生成效果。它解决了从文字★ 633remiRemi 是一个基于 Transformer 的流行钢琴音乐生成工具,源自 ACM Multimedia 2020 论文。它解决了传统音乐生成模型难以捕捉节奏感★ 606JJazzLabJJazzLab 是一款开源的自动伴奏生成应用,专为音乐人、练习者和即兴演奏者设计。它解决了在没有真实乐队的情况下,如何快速获得高质量伴奏音乐的问题。用户只需输★ 594musical-neural-netmusical-neural-net 是一个用 LSTM 循环神经网络训练生成钢琴或小提琴/钢琴合奏音乐的早期开源项目。它解决的核心问题是:如何让机器学会模仿特★ 567open-musiclmopen-musiclm 是 MusicLM 的开源实现,MusicLM 是 Google Research 提出的文本生成音乐模型。该项目在原始论文基础上做了★ 560ICASSP-2023-24-Papers这是一个汇集ICASSP 2023和2024会议论文的仓库,旨在为声学、语音和信号处理领域的研究者提供一站式的论文集合。项目解决了学术会议论文分散、难以系统追踪★ 525muspyMusPy 是一个用于符号音乐生成的开源 Python 工具包,旨在为音乐生成研究和应用提供统一、高效的基础设施。它解决了音乐生成领域中数据格式混乱、数据集不兼★ 525VODERVODER(Voice Operation and Design Engine with Reproduction)是一个基于Python的语音操作与设计引擎,★ 520awesome-ai-voiceawesome-ai-voice 是一个精选开源 AI 语音与音乐生成资源的列表,收录了文本转语音(TTS)、声音克隆、语音识别(ASR)以及音乐生成等领域的模★ 500awesome-ai-music-generation这是一个精选的AI音乐生成资源与项目合集,旨在整理和展示利用机器学习算法进行音乐创作的开源工具、模型、论文和平台。它解决了AI音乐领域资源分散、信息查找困难的问★ 498Awesome-Singing-Voice-Synthesis-and-Singing-Voice-Conversion这是一个关于歌声合成(SVS)与歌声转换(SVC)的精选论文与项目列表,同时涵盖语音合成(TTS)、语音转换(VC)及相关领域(如音乐合成、自动音乐转录、MOS★ 494audio-development-toolsAudio Development Tools (ADT) 是一个面向音频技术研发的开源项目,旨在整合声音、语音和音乐领域的开发工具链。它解决音频开发者缺乏统一★ 469awesome-audio-plaza这是一个每日更新的音频方向前沿论文精选列表,聚焦音乐生成、零样本语音合成、语音识别和通用音频生成等热门子领域。项目以GitHub仓库形式维护,通过持续追踪arX★ 410POP909-DatasetPOP909-Dataset 是一个面向流行音乐编曲生成研究的开源数据集,由上海交通大学缪斯实验室发布,对应论文《POP909: A Pop-song Data★ 410NexiorNexior 是一个基于 Vue 3 和 Capacitor 构建的消费级 AI 应用,集成了聊天、图像生成、视频生成和音乐创作等多项功能。它通过 Ace Da★ 397midi-modelmidi-model 是一个基于 Transformer 架构的符号音乐生成工具,专门处理 MIDI 事件序列。它解决的问题是如何利用深度学习模型自动生成结构合★ 379audio.cpp-webuiaudio.cpp-webui 是一个基于 ggml 的纯 C++ 音频模型推理引擎,为 audio.cpp 提供全任务 WebUI。它支持语音合成(TTS)、★ 369ACE-Step-StudioACE-Step-Studio 是一个便携式 AI 音乐生成工具,旨在让用户完全离线地创作完整歌曲,包括人声、翻唱和音乐视频。它解决了传统 AI 音乐生成依赖云★ 357vampnetvampnet 是一个基于掩码变换器(masked transformer)的音频音乐生成开源项目。它解决的是音乐生成中可控性与生成质量平衡的问题,核心能力在于★ 357MusicGeneratorMusicGenerator 是一个基于 TensorFlow 的实验性开源项目,旨在探索多种深度学习模型在音乐生成领域的应用。它解决了如何利用神经网络自动生成★ 338video-bgm-generationvideo-bgm-generation 是 ACM MM 2021 最佳论文的开源实现,旨在为视频自动生成背景音乐。它解决的核心问题是视频与音乐匹配难、人工配★ 327Tegridy-MIDI-DatasetTegridy-MIDI-Dataset 是一个用于音乐 AI 模型训练的高质量 MIDI 数据集项目。它解决了音乐生成、转录等任务中缺乏干净、结构化 MIDI★ 296DeepLearningMusicGenerationDeepLearningMusicGeneration 是一个专注于深度学习音乐生成领域的开源项目,旨在汇总和展示当前最先进的音乐生成技术与研究成果。它解决了音★ 287pattrnspattrns 是一个用 Rust 编写的实验性命令式音乐序列生成引擎。它解决的是传统音乐编程中序列生成方式不够直观、难以表达复杂节奏和旋律变化的问题。核心能力★ 265MusicTransformer-PytorchMusicTransformer-Pytorch 是一个基于 PyTorch 框架实现的音乐生成项目,针对 MaestroV2 数据集编写,复现了 Google★ 262RaveForceRaveForce 是一个面向音乐生成实验的 OpenAI Gym 风格工具包。它解决了音乐生成研究中缺乏标准化实验环境的问题,为强化学习(RL)和生成式模型提★ 252ai-djai-dj 是一个面向现场音乐表演的 AI 音乐生成工具,以 C++ 编写,基于 JUCE 框架,支持作为独立应用(通过 Ableton Link 同步)或 V★ 250Los-Angeles-Music-ComposerLos-Angeles-Music-Composer 是一个基于局部窗口注意力的多乐器音乐生成 Transformer 模型,专注于有监督的音乐生成任务。它解决★ 242portable-hermes-agentportable-hermes-agent 是一个将 Hermes Agent 打包为 Windows 便携式桌面应用的早期项目,旨在让用户无需安装、无需 Do★ 228papeg_aiPapeg.ai 是一个基于 JavaScript 的本地优先 AI 创意工具集,集成了图像生成、音乐生成、写作辅助和聊天功能。它解决的是用户对隐私敏感、希望离★ 228VersBandVersBand 是一个基于 PyTorch 的歌曲生成框架,对应 EMNLP 2025 论文,主打通过提示词(prompt)进行精细控制。它解决的是传统音乐生★ 226