kokoro-tts-addon

在浏览器里离线跑神经TTS,低配硬件也能流畅发声。

kokoro-tts-addon 是一个面向浏览器的本地神经文本转语音(TTS)解决方案,旨在让网页应用无需联网即可获得高质量、富有表现力的语音合成能力。它基于 Kokoro 模型,通过 JavaScript 实现,能在普通硬件上流畅运行,解决了传统云端 TTS 依赖网络、延迟高、隐私风险大等问题。项目核心能力包括:完全离线运行,保护用户隐私;语音自然度高,支持多种情感和语调;轻量级设计,对 CPU 和内存占用友好,适合在低配设备或移动端使用。此外,它提供了简洁的 API,方便开发者快速集成到网页中,并支持自定义语音参数,满足不同场景的个性化需求。作为早期项目,它展示了本地 TTS 在浏览器端的巨大潜力,为构建响应式、可访问的语音交互应用提供了新选择。

开源 free 音频音乐
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 66
维护状态 低维护
是否开源
定价模式 free

项目数据

分类音频音乐
开发团队pinguy
所属国家
定价模式free
价格说明开源项目,Apache-2.0许可证,本地部署,完全免费。
访问状态
是否开源
开源协议Apache-2.0
主要语言JavaScript
技术栈/模型accessibility,kokoro,offline,text-to-speech,tts,voice
GitHub 星标★ 66
30天Star增速
HF 下载量
上线时间2025-06-12 00:00:00
最近更新2026-08-20 00:00:00
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数3

使用教程

核心亮点

  • 完全离线运行,无需网络请求,保护用户隐私,降低延迟。
  • 基于神经模型,语音自然度和表现力优于传统拼接式TTS。
  • 轻量级实现,对硬件要求低,能在普通笔记本和移动设备上运行。

不足之处

  • 项目处于早期阶段,API 和功能可能不稳定,文档和社区支持待观察。
  • 语音库和语言支持可能有限,扩展性需依赖社区贡献。

适用场景

  • 网页无障碍阅读,为视障用户提供即时语音播报。
  • 离线环境下的语音助手或交互式应用,如电子学习工具。
  • 隐私敏感场景,如医疗或金融应用,避免语音数据上传云端。

替代项目

Coqui TTS、Mozilla TTS、espeak-ng

项目介绍

kokoro-tts-addon 是音频音乐领域的开源项目,由 pinguy 开发,2025 年首次发布。

它收录于音频音乐分类,该分类目前共有 738 个项目,GitHub 星标数为 66。

项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-08-20。Apache-2.0许可证,本地部署,完全免费。

它主要面向的使用场景是:网页无障碍阅读,为视障用户提供即时语音播报。同类可对比的替代方案包括 Coqui TTS、Mozilla TTS、espeak-ng。

同类项目推荐

tango 开源

输入一句话,自动生成匹配的音频内容

A family of diffusion models for text-to-audio generation.

★ 1239 2026-08-09
AuK 开源

一个模型搞定语音生成、编辑与分离

AuK: An Open-Source Foundational Model for Speech Generation and Editing

★ 1236 2026-09-13
swift-tts 开源

Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine

A straightforward package containing version for Swift modern concurrency, Point-Fre···

★ 52 2026-08-09
ai-dj 开源

现场演出中实时用 AI 生成音乐,保持人类掌控

AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···

★ 245 2026-08-09