personaplex-mlx 是音频音乐领域的开源项目,由 mu-hashmi 开发,是 2026 年新上线的项目。
它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 85。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-22。MIT许可证,完全免费,可自行部署使用。
它主要面向的使用场景是:Mac上开发本地语音助手原型。同类可对比的替代方案包括 whisper.cpp、ollama、llama.cpp。

在 Mac 上本地运行全双工语音对话,实时交互不依赖云端
PersonaPlex-MLX 是 NVIDIA PersonaPlex 全双工语音对话模型在 Apple Silicon 上的 MLX 移植版,旨在让 Mac 用户本地运行实时语音交互。它解决了原始模型依赖 NVIDIA GPU 的问题,通过 MLX 框架适配苹果芯片,支持实时本地/网页模式以及离线 WAV 推理。核心能力包括:基于 Moshi 架构的流式语音到语音对话、低延迟全双工交互、无需云端即可保护隐私。项目提供 Python API 和命令行工具,可加载 Hugging Face 模型权重,适合开发者集成到语音助手或实验中。
whisper.cpp、ollama、llama.cpp
personaplex-mlx 是音频音乐领域的开源项目,由 mu-hashmi 开发,是 2026 年新上线的项目。
它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 85。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-22。MIT许可证,完全免费,可自行部署使用。
它主要面向的使用场景是:Mac上开发本地语音助手原型。同类可对比的替代方案包括 whisper.cpp、ollama、llama.cpp。
上一篇:talkie
tango
开源
输入一句话,自动生成匹配的音频内容
A family of diffusion models for text-to-audio generation.
AuK
开源
一个模型搞定语音生成、编辑与分离
AuK: An Open-Source Foundational Model for Speech Generation and Editing
swift-tts
开源
Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine
A straightforward package containing version for Swift modern concurrency, Point-Fre···
ai-dj
开源
现场演出中实时用 AI 生成音乐,保持人类掌控
AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···