open-webui-tools
开源
给 Open WebUI 装上 15 个工具,语音音乐能力一键扩展
专为 Open WebUI 打造的模块化工具集,提供 15 余种专业工具、函数管道与过滤器,可将 Open WebUI ···
汇聚全球AI音频与音乐生成项目,AI语音合成、音乐创作、音频处理工具一网打尽。
open-webui-tools
开源
给 Open WebUI 装上 15 个工具,语音音乐能力一键扩展
专为 Open WebUI 打造的模块化工具集,提供 15 余种专业工具、函数管道与过滤器,可将 Open WebUI ···
audio-diffusion
开源
像画图一样生成音乐,给段描述就出专属旋律
利用 Hugging Face 的 diffusers 库将扩散模型应用于音乐合成,把图像生成领域的扩散技术迁移到音频···
MidiTok
开源
把乐谱变成 AI 的口粮,喂饱它就能源源不断写歌
专为深度学习模型设计的 MIDI 与符号音乐分词器,提供多种 tokenization 策略,可将符号音乐高效转···
tuneflow-py
开源
编曲软件里直接跑 AI,灵感落地不用切工具
将 AI 与音乐算法带入下一代 DAW 的 Python 工具包,支持在数字音频工作站中直接构建音乐算法与 AI···
audio-ai-hub
开源
音频 AI 研究资料一站式导航,想找什么都有门路
音频 AI 研究一站式导航,系统汇集论文、开源模型、基准测试与数据集,覆盖音频大模型、语音识别、···
ai-audio-datasets
开源
语音、音乐、音效数据一网打尽,做 AI 不愁没料
覆盖语音、音乐与音效的 AI 音频数据集合集,为生成式 AI、AIGC、模型训练与智能音频工具开发提供高···
musegan
开源
一句话生成乐队合奏,钢琴吉他鼓点全齐活
MuseGAN 是一个基于生成对抗网络的音乐生成模型,可生成多轨、多乐器协同的复调音乐,支持钢琴曲与···
ace-step-ui
开源
本地无限量生成音乐,免费白嫖 Suno 同款
开源免费的 ACE-Step 1.5 AI 音乐生成专业界面,被誉为 Suno 的最佳开源替代。本地运行、无限生成、···
YuE
开源
写句歌词就出一整首歌,人声伴奏全都有
YuE 是开源的全曲目音乐生成基础模型,功能类似 Suno.ai 但完全开放。支持生成带人声的完整歌曲,涵···
argmax-oss-swift
开源
Mac 上离线跑语音 AI,不联网也能识别和配音
专为 Apple Silicon 打造的端侧语音 AI 框架,支持在设备本地运行语音识别与合成等模型,无需联网与···
StyleTTS2
开源
音色情绪几乎以假乱真,听不出是机器在读
StyleTTS 2 通过风格扩散与对抗训练,结合大型语音语言模型,实现了接近人类水平的文本转语音。合成···
MeloTTS
开源
中英日韩法西六国语言配音,一条龙全包
MyShell.ai 开源的高质量多语言 TTS 库,支持英语、西班牙语、法语、中文、日语、韩语六种语言。合···