mediamolder

图形界面跑 FFmpeg,顺手把 AI 检测和转写一起做了

mediamolder 是一个用 Go 重写的 FFmpeg 风格多媒体处理工具,目标是做「AI 时代的 FFmpeg」。它保留转码、封装、编解码等传统能力(支持 x264/x265/AV1、MP4、流媒体等),同时把 AI 能力直接内置进处理管线:集成 YOLOv8 做物体与人脸检测、Whisper 做语音转写、Vidi2.5 做视频理解,并提供 React 图形界面,让不熟悉命令行的用户也能完成复杂任务。它解决的是传统 FFmpeg 参数复杂、AI 处理需要额外拼装 Python 脚本与模型服务的问题,把「解码—AI 分析—再编码」串成一条流水线,适合做视频内容审核、自动打标、字幕生成、智能剪辑预处理等。项目用 Go 编写,便于编译成单文件部署,目前处于早期阶段,星标约 109。

开源 free 视频生成
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 109
维护状态 较活跃
是否开源
定价模式 free

项目数据

分类视频生成
开发团队MediaMolder
所属国家
官网地址
定价模式free
价格说明开源免费项目,无在线服务,需自行部署
访问状态
是否开源
开源协议LGPL-2.1
主要语言Go
技术栈/模型ai,audio,av1,codec,encoding,ffmpeg,go,gui,image-processing,libraw,mp4,streaming,transcoding,video,x264,x265,yolo,yolov8
GitHub 星标★ 109
30天Star增速
HF 下载量
上线时间2026-04-14 00:00:00
最近更新2026-09-16 00:00:00
维护状态较活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-23
浏览次数0

使用教程

核心亮点

  • 把 YOLOv8 检测、Whisper 转写和转码串在同一条管线里,省去自己拼 Python 脚本和模型服务
  • 提供 React GUI,转码、检测等参数可视化,降低 FFmpeg 命令行门槛
  • Go 实现便于编译为单文件二进制,部署和分发比 Python 方案更简单

不足之处

  • 项目处于早期,星标仅约 109,功能完整度和稳定性有待验证
  • AI 模型依赖较重,实际运行对 GPU/内存和模型下载有额外要求

适用场景

  • 批量视频自动打标与内容审核
  • 为视频自动生成字幕和转写文本
  • 智能剪辑前的素材预处理与格式统一

替代项目

FFmpeg、HandBrake、Auto-Editor

项目介绍

mediamolder 是视频领域的开源项目,由 MediaMolder 开发,是 2026 年新上线的项目。

它收录于视频分类,该分类目前共有 471 个项目,GitHub 星标数为 109。

项目保持着较活跃的维护节奏,最近一次代码更新于 2026-09-16。开源免费项目,无在线服务,需自行部署。

它主要面向的使用场景是:批量视频自动打标与内容审核。同类可对比的替代方案包括 FFmpeg、HandBrake、Auto-Editor。

上一篇:opensource-clipping

下一篇:VideoHub

同类项目推荐

MoneyPrinterTurbo 开源

输入一句话,高清短视频自动出炉,文案配音全包了

利用 AI 大模型和自动化工作流,根据主题或关键词一键生成高清短视频。Generate HD short ···

★ 125106 2026-08-09
seedance-2.0-api 开源

快速上手字节Seedance 2.0,文本/图片一键生成视频

Seedance 2.0 API — text-to-video and image-to-video examples

★ 334 2026-08-26
openscreen 开源

免费无水印录屏做演示,替代 Screen Studio

Record your screen, ship a demo. Free and open-source, GPU-accelerated, no watermark···

★ 3072 2026-08-10
auto-subs 开源

在剪辑软件里直接生成字幕,省去导出导入的麻烦

On-device subtitle generation that connects directly to DaVinci Resolve, Premiere, a···

★ 4244 2026-08-10