text-to-music

本站收录 12 个带「text-to-music」标签的 AI 开源项目

OpenMusicOpenMusic 是一个基于 Python 的文本生成音乐(Text-to-Music)开源项目,旨在实现当前最先进的(SOTA)音乐生成效果。它解决了从文字★ 633open-musiclmopen-musiclm 是 MusicLM 的开源实现,MusicLM 是 Google Research 提出的文本生成音乐模型。该项目在原始论文基础上做了★ 560Awesome-LLMs-meet-Multimodal-Generation这是一个精选论文列表,聚焦于基于大语言模型(LLM)的多模态生成领域,涵盖图像、视频、3D和音频四大模态。项目系统梳理了LLM与多模态生成结合的前沿研究,包括多★ 552mustangoMustango是一个面向可控文本生成音乐的开源模型,旨在解决现有文本到音乐生成中控制能力弱、语义对齐差的问题。它基于音乐理解模型和潜在扩散模型,通过引入音乐相★ 396ACE-Step-StudioACE-Step-Studio 是一个便携式 AI 音乐生成工具,旨在让用户完全离线地创作完整歌曲,包括人声、翻唱和音乐视频。它解决了传统 AI 音乐生成依赖云★ 357xcodecxcodec 是一个面向音频语言模型的语义编解码器,由香港科技大学等机构在 AAAI 2025 提出。它针对传统音频编解码器(如 EnCodec)在语义信息保留★ 316doubao2apidoubao2api 是一个通过逆向工程将字节跳动旗下豆包(Doubao)的私有接口转换为 OpenAI 兼容 REST 服务的开源项目。它解决了开发者无法直接★ 252Los-Angeles-Music-ComposerLos-Angeles-Music-Composer 是一个基于局部窗口注意力的多乐器音乐生成 Transformer 模型,专注于有监督的音乐生成任务。它解决★ 242remiqoraremiqora 是一个本地 AI 音乐工作室,把 ACE-Step 1.5 与 YuE2-3B 两个音乐生成模型整合进同一个 Vue 界面,并内置多轨 DAW★ 129ComfyUI-audioComfyUI-audio 是一个为 ComfyUI 平台开发的音频生成工具集,旨在将音乐生成、文本转语音等音频能力集成到 ComfyUI 的可视化节点工作流中★ 106Perceiver-Music-TransformerPerceiver-Music-Transformer 是 Google Perceiver-AR 架构在音乐生成领域的开源实现,旨在解决长序列音乐建模中计算成★ 104AwesomeMultiModel这是一个AIGC实战入门笔记项目,旨在帮助开发者系统学习和上手各类AIGC技术。项目内容覆盖大语言模型(LLMs)、高效微调(SFT)、检索增强生成(RAG)、★ 79