video-processing
本站收录 45 个带「video-processing」标签的 AI 开源项目
supervisionsupervision 是一个专注于计算机视觉的可复用工具库,旨在简化视觉任务的开发流程。它解决了开发者在目标检测、分割、分类等任务中重复编写样板代码的问题,提★ 51,079
mediapipeMediaPipe 是 Google 开源的跨平台机器学习解决方案框架,专为实时和流媒体场景设计。它解决的是开发者难以高效构建、部署和优化多模态 ML 应用的问★ 37,118
memvidmemvid 是一个为 AI 代理提供记忆层的开源项目,旨在用无服务器、单文件的记忆层替代复杂的 RAG 流水线。它解决了 AI 代理在长期对话或任务中缺乏持久★ 16,566
autoclipAutoClip 是一款基于 AI 的视频高光提取与自动剪辑工具,主要面向视频二创和内容分发场景。它利用大语言模型和视频处理技术,自动分析视频内容,识别并提取精★ 9,044
FunClipFunClip 是一个基于阿里达摩院 FunASR 语音识别模型的开源视频剪辑工具,主要解决视频中语音内容的快速定位与剪辑问题。它提供本地 Gradio 网页界★ 6,354
remove-ai-watermarks这是一个用于移除AI生成图像水印的命令行工具和Python库,主要针对Google Gemini(Nano Banana)的可见星标水印、SynthID隐形水印★ 5,716
towheeTowhee 是一个专注于神经数据处理的 Python 框架,旨在让构建和运行 AI 驱动的数据管道变得简单高效。它解决的是从原始数据(文本、图像、音视频等)到★ 3,450
SnapOtterSnapOtter 是一个开源、可自托管的文件处理工具,旨在解决个人和企业处理图片、视频、音频、PDF 及文档时依赖云端服务导致的数据隐私和合规问题。它集成了格★ 2,755
streamlit-webrtcstreamlit-webrtc 是一个让 Streamlit 应用直接处理实时音视频流的开源组件。Streamlit 本身擅长快速搭建数据应用,但原生不支持摄★ 1,706
DirectorDirector 是一个面向下一代视频交互与工作流的 AI 智能体框架,基于 Python 构建。它旨在解决视频内容生成、编辑和处理过程中缺乏统一智能编排的问题★ 1,540
videoflowVideoflow 是一个用 Python 编写的视频分析应用开发框架,核心目标是让开发者用搭积木的方式快速构建复杂的多进程视频处理流水线。它把视频处理拆解为生★ 1,040
StoryToolkitAIStoryToolkitAI 是一款面向视频剪辑师和电影制作人的 AI 辅助编辑工具,它通过自动转录视频/音频内容,并结合 ChatGPT 等大语言模型,让用户★ 1,020
TikTok-Compilation-Video-Generator这是一个用于自动生成TikTok合集视频的机器人系统,由三个独立程序组成:自动采集、浏览筛选和视频合成。它通过自定义过滤器自动收集视频片段,用户可轻松浏览并挑选★ 965
ai-video-editorai-video-editor 是一个本地优先的浏览器端 AI 视频编辑器,利用 WebGPU 在浏览器中直接运行 AI 模型,无需上传视频到云端,保护隐私。它★ 881
bacalhauBacalhau 是一个社区驱动的分布式计算框架,专注于在数据所在位置执行计算,实现快速、低成本的‘数据计算’(Compute over Data)。它解决了传★ 873
caercaer 是一个面向计算机视觉研究的高性能 Python 库,旨在减少样板代码,让研究者专注于核心算法。它整合了图像处理、数据增强、模型训练与评估等常用功能,提★ 818
APTAPT 是一个开源的 AI 生产力工具,旨在通过本地化部署和隐私保护提升用户效率。它内置了 ChatGPT、DeepSeek、Phi、Qwen 等模型的本地专属★ 770
SparkVSRSparkVSR 是一个基于稀疏关键帧传播的交互式视频超分辨率工具,由 ECCV 2026 论文提出。它解决传统视频超分方法计算量大、无法实时交互的问题,通过智★ 741
vmodal_sdk_androidvmodal_sdk_android 是一个面向 Android 平台的视频搜索 SDK,使用 Kotlin 编写,旨在帮助开发者快速将视频搜索能力集成到任意视★ 582
openclipOpenClip 是一个用 Python 编写的开源工具,专门解决长视频中精彩片段难以快速定位的问题。它借助大语言模型和 AI 分析能力,自动从数小时的长视频里★ 566
StreamRAGStreamRAG 是一个基于 Python 的视频搜索与流式处理代理,旨在解决视频内容检索和实时流式处理中的效率问题。它利用检索增强生成(RAG)技术,将视频★ 503
FILTER.jsFILTER.js 是一个用纯 JavaScript 实现的图像、视频处理与计算机视觉库,目标是在浏览器和 Node.js 环境中提供类似 OpenCV 的能力★ 399
OmniShotCutOmniShotCut 是一个专注于镜头边界检测(Shot Boundary Detection)的开源项目,用 Python 实现。它要解决的问题是:在视频处★ 317
timeline-studioTimeline Studio 是一个基于 TypeScript 的开源视频编辑工具,旨在通过 AI 技术简化视频创作流程。它解决的是传统视频编辑软件学习曲线陡★ 217
autoshortsautoshorts 是一个自动化短视频生成工具,专注于从长格式游戏录像中提取高光片段并制作成适合 TikTok 等平台的竖屏短视频。它利用 AI 场景分析(支★ 203
VEFX-BenchVEFX-Bench 是一个面向通用视频编辑与视觉特效(VFX)的综合性基准测试项目。它旨在解决视频编辑和特效领域缺乏统一、全面评估标准的问题,为生成式 AI ★ 175
lipsynclipsync 是一个基于 Wav2Lip 的 Python 唇形同步库,旨在简化视频和图片中人物嘴唇与音频的同步过程。它解决了传统唇形同步工具配置复杂、推理速★ 153
model-composemodel-compose 是一个受 docker-compose 启发的 AI 服务部署工具,旨在通过一个 YAML 文件快速定义和部署生产级的 AI 服务,★ 117
generativepygenerativepy 是一个用于创建生成艺术和数学动画的 Python 库。它解决了艺术家、数学家和教育者需要以编程方式生成可视化内容但不想深入底层图形 A★ 110
ComfyUI-Wan-VACE-Video-Joiner这是一个为ComfyUI设计的视频拼接工作流项目,利用Wan VACE模型在视频片段之间创建平滑的过渡效果。它解决的是视频编辑中常见的硬切问题,让不同来源的视频★ 108
subforgesubforge 是一个用 Rust 编写的命令行工具,面向视频字幕的完整 AI 处理流水线。它把字幕工作中最繁琐的环节串成一条命令:先用 faster-whi★ 104
ComfyUI-Wan-VACE-PrepComfyUI-Wan-VACE-Prep 是一个专为 ComfyUI 设计的自定义节点包,旨在简化视频生成模型在常见编辑任务中的使用流程。它主要针对 Wan ★ 101
JARVIS-MARK5JARVIS-MARK5 是一个以 Python 编写的个人 AI 助手项目,旨在为每个人提供类似钢铁侠中 JARVIS 的智能助理体验。它集成了图像生成、图像★ 94
ai-mixed-cutai-mixed-cut 是一个基于 AI 的视频再创作引擎,核心思路是“解构-重构”爆款视频模式。它通过 LLM 分析和理解现有视频的内容结构,自动拆解出关键★ 93
Awesome-AVIAwesome-AVI 是一个关于音频-视觉智能(Audio-Visual Intelligence)的精选资源列表,旨在系统梳理该领域的前沿研究、工具和数据集★ 90
distributed-inference这是一个用 Go 语言编写的演示项目,旨在展示如何在深度学习/机器学习领域设计跨语言、分布式的推理管道。它利用 WebRTC 和 Redis Streams 作★ 86
R-ESRGAN-AnimeVideo-UIreav-ui 是一个基于 R-ESRGAN 的视频放大工具,专注于动漫和卡通内容的画质提升。它解决了动漫视频在放大时出现的模糊、锯齿和细节丢失问题,利用增强型★ 84
controlnetvideocontrolnetvideo 是一个将 ControlNet 应用于视频片段的开源工具,旨在解决 ControlNet 在视频序列中逐帧应用时产生的闪烁和风格★ 84
Pulse-of-MotionPulse-of-Motion 是一个面向物理感知视频生成的早期开源项目,核心目标是解决生成视频中物体运动不符合物理规律的问题。它通过从视觉动态中测量物理帧率,★ 73
VideoGraphAIVideoGraphAI 是一个基于 Python 的 AI 自动化工具,专门用于生成 YouTube Shorts 短视频。它利用大语言模型(LLM)进行内容★ 71
CShadeCShade 是一组专为 ReShade 设计的图像与视频处理着色器集合,使用 HLSL 编写,旨在为游戏和视频画面提供实时增强效果。它解决的是传统 ReSha★ 63
deepdream-video-pytorch这是一个基于PyTorch的DeepDream视频处理工具,旨在为视频添加梦幻般的艺术效果,同时保持时间一致性。它解决了普通DeepDream逐帧处理视频时产生★ 62
PokoraPokora 是一个完全本地运行的 AI 视频创作平台,基于 Stable Diffusion 构建,采用原生 SwiftUI 界面,专为 macOS 用户设计★ 55
AutomatedYoutubeShortsAutomatedYoutubeShorts 是一个基于 Python 的自动化工具,旨在根据用户提供的文本内容自动生成 YouTube Shorts 短视频。★ 55
openscenesense-ollamaOpenSceneSense Ollama 是一个基于 Python 的本地视频分析库,它利用 Ollama 运行的开源 AI 模型,对视频进行帧级和音频级的智★ 53