haoone-app

本地跑 AI 字幕,转录对齐说话人一步到位

开源 unknown 语音识别
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 625
维护状态 活跃
是否开源 是
定价模式 unknown

项目预览

项目数据

分类语音识别
开发团队minghe36
所属国家
定价模式unknown
价格说明定价信息待确认
访问状态
是否开源是
开源协议
主要语言MDX
技术栈/模型caption,caption-generation,caption-generator,captioning,captions,subtitle,subtitles-generator
GitHub 星标★ 625
30天Star增速
HF 下载量
上线时间2026-05-11 00:00:00
代码更新—
仓库体积—
本站数据更新—
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-10-12
浏览次数0

项目介绍

haoone-app 是一款面向视频创作者与字幕工作者的本地 AI 字幕软件,目标是替代剪映、ElevenLabs 等云端字幕方案。它内置先进的 ASR 开源模型,中英转录识别准确率超过 97%,词语音频对齐率 98%,说话人分割与识别准确率 96%。核心能力覆盖语音转文本、说话人识别、专业字幕编辑器、文稿匹配、智能拆行、AI 校正、AI 智能热词、翻译与双语字幕、字幕合成等完整流程。它提供命令行工具与 Skill,并支持达芬奇、Premiere 字幕插件,其中字幕动画插件可导出透明背景动画,内置 100 多种字幕动画样式。用户既可本地转录,也可远程转录,还能自定义大模型 API 做 AI 校正与翻译,适合追求数据私密与高精度字幕的团队和个人。

Star 增长趋势

本站每日记录该项目 GitHub 星标变化,观测越久曲线越完整

正在加载星标数据…

技术标签

使用教程

—

核心亮点

  • 转录、对齐、说话人识别三项准确率均达 96%-98%,指标明确
  • 内置 100+ 字幕动画并支持导出透明背景,达芬奇/PR 插件直接可用
  • 本地转录加自定义大模型 API,数据不出本机,兼顾隐私与灵活扩展

不足之处

  • 项目早期,625 星,文档与社区生态仍在建设
  • 以 MDX 为主,实际部署与多平台兼容性需自行验证

适用场景

  • 自媒体创作者批量给口播视频加中英双语字幕
  • 影视团队在达芬奇/Premiere 中做带说话人标记的专业字幕
  • 需要数据保密的机构用本地转录替代云端字幕服务

替代项目

whisper、Buzz、Subtitle Edit

上一篇:dotty-stackchan

下一篇:没有了!

同类项目推荐

obs-localvocal 开源

直播录屏时,本地AI实时生成字幕,保护隐私零延迟

OBS plugin for local speech recognition and captioning using AI

★ 1630 2026-09-10
LiveCaptions-Translator 开源

实时捕获系统音频,一键翻译成你懂的语言

Lightweight and powerful real-time audio/speech translation tool based on Windows Li···

★ 3854 2026-08-10
speechbrain 开源

一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务

A PyTorch-based Speech Toolkit

★ 11864 2026-08-26
whisper-diarization 开源

给语音转写加上说话人标签,会议记录一目了然

Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper

★ 5662 2026-08-13