SmartSub

本地离线搞定字幕生成、翻译、配音和烧录,一站式高效处理

SmartSub 是一款免费开源的桌面端一站式字幕工具,主要解决视频创作者和翻译者在字幕生成、翻译、配音和烧录过程中的效率问题。它基于 Whisper、FunASR 等本地模型实现离线语音转文字,支持批量处理,并利用 GPU 加速提升性能,覆盖 Windows、macOS 和 Linux 平台。核心能力包括:本地语音识别生成字幕、多语言字幕翻译、AI 配音与声音克隆、字幕烧录到视频。用户无需上传数据到云端,保障隐私安全。项目采用 TypeScript 开发,技术栈丰富,支持多种主流 ASR 模型和翻译引擎,适合个人创作者、字幕组和本地化团队使用。

开源 free 语音识别
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 5309
维护状态 活跃
是否开源 是
定价模式 free

项目数据

分类语音识别
开发团队buxuku
所属国家
定价模式free
价格说明完全免费开源,本地运行,无付费版本。
访问状态
是否开源是
开源协议MIT
主要语言TypeScript
技术栈/模型deepseek,faster-whisper,fireredasr,funasr,ollama,openai,qwen3-asr,sherpa-onnx,subtitle,translate,whisper,whisper-cpp
GitHub 星标★ 5309
30天Star增速
HF 下载量
上线时间2024-05-21 00:00:00
最近更新2026-09-22 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-10
浏览次数6

使用教程

难度:入门 约 10 分钟 部署方式:本地安装 6 步

环境要求

  • Windows x64 系统(NVIDIA 显卡可用 CUDA,AMD / Intel 用 Vulkan,加速包在应用内下载)
  • macOS Apple 芯片(自动启用 Core ML / Metal 加速)
  • macOS Intel 芯片(仅 CPU,不支持 GPU 加速)
  • Linux x64 系统(NVIDIA 用 CUDA,AMD / Intel 用 Vulkan,应用内下载)
  • 无 GPU 也可使用,可跟随引导下载模型或配置云端听写

安装与启动步骤

  1. 1下载安装包

    打开 GitHub Releases 或夸克网盘,按系统和芯片选择对应安装包下载并安装,GPU 加速包无需在此处选择。

  2. 2Homebrew 安装(macOS)

    macOS 用户推荐用 Homebrew 安装,会自动匹配芯片类型;第一行只需执行一次。

    brew tap buxuku/tap
    brew install --cask smartsub
  3. 3升级应用(可选)

    已通过 Homebrew 安装的用户,后续可直接用该命令升级到新版本。

    brew upgrade --cask smartsub
  4. 4下载语音模型

    安装后跟随新手引导下载一个语音模型;无 GPU 或不想下载模型时,可改为配置云端听写。

  5. 5新建并处理任务

    在启动台选择任务,拖入音视频或字幕文件(或粘贴在线视频链接下载),设置源语言、目标语言等参数后开始处理。

  6. 6校对与合成

    处理完成后可继续校对字幕、配音或烧录合成,形成完整字幕与配音流水线。

关键配置

配置项必填说明示例
API Key否接入云端翻译、云端听写或云端配音服务时填写,本地流程不需要sk-xxxxxxxx

如何确认成功

应用安装后能正常打开并出现新手引导,可成功下载语音模型、拖入文件并开始处理任务。

常见问题

Q:整条流程必须付费或用 API Key 吗?

A:不需要。本地模型转写、内置免费翻译源、本地 TTS 配音(含声音克隆)、本地 ffmpeg 烧录可完全免费跑通,本地环节也没有用量限制。

Q:GPU 加速包要在下载时选择吗?

A:不用。GPU 加速包在下载安装包时无需选择,安装后在应用内按需下载,NVIDIA 用 CUDA,AMD / Intel 用 Vulkan。

Q:macOS Intel 机型能 GPU 加速吗?

A:不能。mac-x64 版本仅支持 CPU,不支持 GPU 加速;Apple 芯片机型会自动启用 Core ML / Metal 加速。

Q:文件会被上传到云端吗?

A:转写基于 whisper.cpp、sherpa-onnx 等本地模型完成,文件不出本机;只有按需接入云端服务时才会走网络。

注意事项

  • 安装包按操作系统与芯片类型选择,选错芯片版本可能无法正常运行。
  • GPU 加速包在应用内按需下载,不必在下载安装包时选择。
  • 本地流程无需 API Key,接入 20 个翻译服务、9 家云端听写、6 类云端配音属于可选增强。

核心亮点

  • 完全离线运行,保护隐私,无需上传视频或音频到云端
  • 支持多种本地模型(Whisper、FunASR 等),灵活适配不同场景和语言
  • 全平台 GPU 加速,批量处理大幅提升字幕生成效率

不足之处

  • 界面和文档以英文为主,中文用户上手有一定门槛
  • 本地模型对硬件要求较高,低配设备可能运行缓慢

适用场景

  • 视频创作者快速生成和翻译字幕,提升内容产出效率
  • 字幕组批量处理多语言视频,降低人工翻译成本
  • 教育机构为课程视频添加多语言字幕和配音,扩大受众

替代项目

Subtitle Edit、VideoSubFinder、Aegisub

项目介绍

SmartSub 是语音识别领域的开源项目,由 buxuku 开发,2024 年首次发布。

在全站 13,014 个收录项目中,它的 GitHub 星标数(5,309)位列前 9%,在语音识别分类的 212 个项目里位列前 13%。

近 44 天,它的 GitHub 星标从 4,555 增加到 5,309,净增 754。

项目目前处于活跃维护状态,最近一次代码更新于 2026-09-22。完全免费开源,本地运行,无付费版本。从国内网络环境看,可直接访问。

它主要面向的使用场景是:视频创作者快速生成和翻译字幕,提升内容产出效率。同类可对比的替代方案包括 Subtitle Edit、VideoSubFinder、Aegisub。

上一篇:openwhispr

下一篇:speaches

同类项目推荐

obs-localvocal 开源

直播录屏时,本地AI实时生成字幕,保护隐私零延迟

OBS plugin for local speech recognition and captioning using AI

★ 1616 2026-09-10
LiveCaptions-Translator 开源

实时捕获系统音频,一键翻译成你懂的语言

Lightweight and powerful real-time audio/speech translation tool based on Windows Li···

★ 3755 2026-08-10
speechbrain 开源

一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务

A PyTorch-based Speech Toolkit

★ 11834 2026-08-26
whisper-diarization 开源

给语音转写加上说话人标签,会议记录一目了然

Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper

★ 5657 2026-08-13