funasr

本站收录 12 个带「funasr」标签的 AI 开源项目

FunASRFunASR 是阿里开源的多语言语音识别工具包,专为中文场景深度优化,同时支持英文、日文等。它解决了从训练到部署的全链路问题,包括语音识别(ASR)、端点检测(★ 20,549SenseVoiceSenseVoice 是阿里开源的语音基础模型,主打多语言语音识别(ASR),支持中文、粤语、英文、日语和韩语。它不仅能转写文字,还集成了语种识别、情感识别和音★ 9,408FunClipFunClip 是一个基于阿里达摩院 FunASR 语音识别模型的开源视频剪辑工具,主要解决视频中语音内容的快速定位与剪辑问题。它提供本地 Gradio 网页界★ 6,354SmartSubSmartSub 是一款免费开源的桌面端一站式字幕工具,主要解决视频创作者和翻译者在字幕生成、翻译、配音和烧录过程中的效率问题。它基于 Whisper、FunA★ 5,423AudioNotesAudioNotes 是一个基于 Python 的语音转文字笔记工具,旨在快速从音视频文件中提取内容并整理成结构化的 Markdown 笔记。它解决了手动听写和★ 2,521bailing百聆是一个类似GPT-4o的语音对话机器人,通过ASR(语音识别)+LLM(大语言模型)+TTS(语音合成)技术栈实现,集成DeepSeek R1等优秀大模型,★ 1,774Fun-ASRFun-ASR 是一个基于大语言模型的开源语音识别(ASR)模型家族,专注于中文、方言、口音及多语言场景。它提供多种运行时支持,包括 FunASR、vLLM、流★ 1,555MToolsMTools 是一款基于 Python 的桌面多功能工具箱,把音视频处理、图片编辑、文本操作和编码工具整合到一个应用里,并内置 AI 增强能力。它想解决的核心问★ 1,352vocotype-cliVocoType 是一款本地端侧运行的隐私安全语音输入工具,通过全局快捷键即可将语音实时转成文字并自动输入到当前应用,无需手动复制粘贴。它基于 FunASR 等★ 948LiveTranslateLiveTranslate 是一款面向 Windows 平台的实时音频翻译工具,主要解决 VTuber、主播和外语内容观众在直播或观看视频时面临的跨语言沟通障碍★ 714FunSpeechFunSpeech 是一个面向本地私有化部署的语音服务工具,旨在简化语音识别(ASR)和语音合成(TTS)后端的搭建流程。它解决了开发者在使用 Qwen3ASR★ 164jkinco-listen-openjkinco-listen-open 是一个本地优先的智能会议纪要工作台,专为需要数据隐私和离线可用的团队设计。它把会议录音转写、场景识别、纪要生成和文档导出整★ 102