audiopipe 是音频音乐领域的开源项目,由 nullwiz 开发,2025 年首次发布。
它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 210。
项目目前处于活跃维护状态,最近一次代码更新于 2026-09-19。开源免费,需自行部署。
它主要面向的使用场景是:批量处理会议录音,自动生成带说话人标签的会议纪要。同类可对比的替代方案包括 whisperX、pyannote-audio、funasr。

一条命令搞定降噪、分人、转写,会议录音秒变带标签文本
audiopipe 是一个面向音频预处理的 Python 流水线工具,核心目标是把「降噪→说话人分离→语音转写」三步串成一条可复用的自动化流程。它底层结合了 insanely-fast-whisper 做高速转写,并集成降噪与说话人日志(diarization)能力,让用户不必自己拼接多个模型和脚本。典型用法是输入一段含背景噪声、可能有多人对话的录音,输出带说话人标签的文本转录结果。项目解决了音频处理中工具链割裂、模型调用繁琐、结果难以对齐的问题,适合需要批量处理会议录音、访谈、播客等场景的开发者快速搭建原型。代码为 Python 实现,结构轻量,目前处于早期阶段,星标约 210,适合作为二次开发或集成到更大语音处理系统的起点。
whisperX、pyannote-audio、funasr
audiopipe 是音频音乐领域的开源项目,由 nullwiz 开发,2025 年首次发布。
它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 210。
项目目前处于活跃维护状态,最近一次代码更新于 2026-09-19。开源免费,需自行部署。
它主要面向的使用场景是:批量处理会议录音,自动生成带说话人标签的会议纪要。同类可对比的替代方案包括 whisperX、pyannote-audio、funasr。
上一篇:nightingale
下一篇:没有了!
tango
开源
输入一句话,自动生成匹配的音频内容
A family of diffusion models for text-to-audio generation.
AuK
开源
一个模型搞定语音生成、编辑与分离
AuK: An Open-Source Foundational Model for Speech Generation and Editing
swift-tts
开源
Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine
A straightforward package containing version for Swift modern concurrency, Point-Fre···
ai-dj
开源
现场演出中实时用 AI 生成音乐,保持人类掌控
AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···