video-editing

本站收录 94 个带「video-editing」标签的 AI 开源项目(按 GitHub 星标从高到低,此处展示前 50 个)

LivePortrait快手开源的人像驱动技术,让静态照片“活”起来。基于单张人像即可生成自然流畅的说话、表情与头部动作视频,广泛应用于数字人、直播互动与影视特效,效果生动逼真。★ 19,132hypithypit 是一个用 TypeScript 编写的开源视频生成工具,目标是把爆款视频的完整制作流程交给 AI 代理自动完成。它不只是生成脚本,而是覆盖换脸、改写★ 17,185KrillinAIKrillinAI 是一个基于大语言模型的 AI 视频翻译与配音工具,面向个人用户和 AI Agent 提供完整的视频本地化流水线,涵盖下载、转录、翻译、TTS★ 12,511autoclipAutoClip 是一款基于 AI 的视频高光提取与自动剪辑工具,主要面向视频二创和内容分发场景。它利用大语言模型和视频处理技术,自动分析视频内容,识别并提取精★ 9,044ShortGPTShortGPT 是一个实验性的 AI 框架,专注于 YouTube Shorts 和 TikTok 频道的自动化内容生成。它解决了短视频创作者在选题、脚本、配★ 7,996FunClipFunClip 是一个基于阿里达摩院 FunASR 语音识别模型的开源视频剪辑工具,主要解决视频中语音内容的快速定位与剪辑问题。它提供本地 Gradio 网页界★ 6,354Awesome-Video-DiffusionAwesome-Video-Diffusion 是一个精心整理的视频扩散模型资源列表,聚焦于视频生成、编辑及相关应用。项目将近年来涌现的扩散模型按用途分类收录,★ 5,789AI-Youtube-Shorts-Generator这是一个开源工具,旨在将长格式的YouTube视频自动转换为适合短视频平台(如TikTok、Shorts、Reels)的9:16竖屏短片。它解决了内容创作者需要★ 5,168auto-subsauto-subs 是一个本地优先的自动字幕生成工具,专为视频剪辑师设计。它直接集成到 DaVinci Resolve、Premiere 和 After Eff★ 4,293Text2Video-ZeroText2Video-Zero 是 ICCV 2023 Oral 论文的官方实现,核心思路是利用预训练的文生图扩散模型(如 Stable Diffusion)直★ 4,244VACEVACE 是一个基于扩散模型的全能视频生成与编辑框架,由腾讯等机构在 ICCV 2025 论文中提出。它解决的核心问题是:当前视频生成模型往往只能完成单一任务(★ 3,957FireRed-OpenStorylineFireRed-OpenStoryline 是一个基于大语言模型的 AI 视频剪辑智能体,旨在将传统的手工剪辑流程转变为意图驱动的导演式创作。它通过自然语言交互★ 3,455openscreenOpenScreen 是一款免费开源的屏幕录制与演示视频制作工具,旨在替代付费的 Screen Studio。它基于 Electron 和 Rust 构建,利用★ 3,358Awesome-Video-Diffusion-Models这是一个关于视频扩散模型的精选资源列表,源自一篇发表在《计算机科学与技术评论》(CSUR)上的综述论文。项目系统梳理了视频扩散模型领域的核心研究,包括模型架构、★ 2,318claude-code-video-toolkitclaude-code-video-toolkit 是一个面向 Claude Code 的 AI 原生视频制作工具包,旨在通过自然语言指令自动化完成视频生产流程★ 2,151OpenChatCutOpenChatCut 是一个开源、本地优先的对话式 AI 视频编辑器,旨在通过自然语言交互简化专业视频剪辑流程。它解决了传统视频编辑软件学习曲线陡峭、操作繁琐★ 2,061TokenFlowTokenFlow 是 ICLR 2024 的官方 PyTorch 实现,用于实现基于扩散模型的视频编辑。它解决了文本到视频编辑中常见的时序不一致问题,即逐帧独★ 1,707MIMOMIMO 是一个可控角色视频合成框架,通过空间分解建模实现高质量的角色动画生成。它解决了现有方法在角色视频生成中运动控制不精细、背景与前景耦合导致编辑困难的问题★ 1,577DirectorDirector 是一个面向下一代视频交互与工作流的 AI 智能体框架,基于 Python 构建。它旨在解决视频内容生成、编辑和处理过程中缺乏统一智能编排的问题★ 1,540LanPaintLanPaint 是一个面向 Stable Diffusion 系列模型的免训练图像修复(inpainting)方案,同时提供 ComfyUI 自定义节点。它要★ 1,416BerniniBernini 是一个统一的视频生成与编辑框架,将基于多模态大语言模型(MLLM)的语义规划器与基于扩散Transformer(DiT)的渲染器相结合。它解决的★ 1,323HunyuanCustomHunyuanCustom 是一个基于多模态驱动的定制化视频生成架构,旨在解决现有视频生成模型难以对特定主体进行个性化控制的问题。它通过融合音频、图像和文本等多★ 1,229wunjo.wladradchenko.ruWunjo CE 是一个本地运行的开源多媒体创作工具,集成了人脸替换、唇形同步、视频生成、物体/文字/背景移除、风格重绘、音频分离和声音克隆等多项 AI 能力。★ 1,171FateZeroFateZero 是一个基于 Stable Diffusion 的零样本文本驱动视频编辑工具,来自 ICCV 2023 Oral 论文。它解决了传统视频编辑需要★ 1,162yt-short-clipperyt-short-clipper 是一款面向 Windows 的桌面应用,专门把 YouTube 长视频自动剪成适合 TikTok、Reels、Shorts 的★ 1,012subvertsubvert 是一个基于 PHP 的视频处理工具,利用 OpenAI 的 Whisper 模型自动为视频生成字幕、摘要和章节。它解决了视频内容创作者手动转录、★ 868open-editopen-edit 是一个面向开发者的本地视频编辑工具,核心理念是“拥有而非租用”视频编辑器。它允许用户通过编码智能体(如 Claude Code、Codex、★ 851Text-To-Video-AIText-To-Video-AI 是一个基于 AI 的文本转视频生成工具,旨在帮助用户通过简单的文字描述快速生成视频内容。它解决了传统视频制作门槛高、耗时长的痛★ 834capcut-clicapcut-cli 是一个独立、非官方的命令行工具,用于直接编辑剪映(JianYing)和 CapCut 的草稿工程文件。它不需要调用任何官方 API,而是直★ 813MagicDanceMagicDance(又称MagicPose)是一个基于扩散模型的人体姿态与面部表情重定向工具,由ICML 2024论文提出。它解决的是在保持人物身份特征(如面★ 778SparkVSRSparkVSR 是一个基于稀疏关键帧传播的交互式视频超分辨率工具,由 ECCV 2026 论文提出。它解决传统视频超分方法计算量大、无法实时交互的问题,通过智★ 741FableCutFableCut 是一个零依赖的浏览器端视频编辑器,专为 AI 智能体设计。它通过 JSON 时间线描述视频结构,提供 MCP(模型上下文协议)和 REST A★ 697DiffuEraserDiffuEraser 是一个基于扩散模型的视频修复(video inpainting)工具,旨在解决视频中移除不需要对象或修复损坏区域时,生成内容与周围环境不★ 695Awesome-CVPR2026-CVPR2025-ICCV2025-CVPR2024-ECCV2026-ECCV2024-AIGC这是一个汇集CVPR、ICCV、ECCV等顶级计算机视觉会议中AIGC相关论文与代码的精选列表。项目旨在解决研究者难以系统追踪前沿AIGC成果的问题,按会议年份★ 676vmodal_sdk_androidvmodal_sdk_android 是一个面向 Android 平台的视频搜索 SDK,使用 Kotlin 编写,旨在帮助开发者快速将视频搜索能力集成到任意视★ 582openclipOpenClip 是一个用 Python 编写的开源工具,专门解决长视频中精彩片段难以快速定位的问题。它借助大语言模型和 AI 分析能力,自动从数小时的长视频里★ 566kirikiri 是一款用 Rust 编写的本地优先桌面工作台,把截图、标注、OCR 文字识别和屏幕录制整合在一个应用里。它解决的是日常工作中截图工具、标注软件、OCR★ 537NomiNomi 是一个开源的 AI 视频工作台,定位为本地优先的桌面应用。它解决的核心问题是:在 AI 视频生成流程中,创作者往往需要在多个工具间切换,且难以对生成结★ 534Light-A-VideoLight-A-Video 是一个无需训练的视频重打光工具,由南洋理工大学等机构提出,论文发表于 ICCV 2025。它解决的是视频编辑中光照不一致的痛点:用户★ 525Orkas-VideoStudioOrkas-VideoStudio 是一个将编程代理转变为视频工作室的开源工具。它允许用户用自然语言描述视频内容,然后由 AI 代理自动编写时间线并生成视频文件★ 497Vidu-SVidu-S 是一个面向实时交互式视频生成的开源项目,核心目标是让视频生成不再是一次性输出,而是可实时编辑、可空间操控的生成过程。它试图解决传统视频生成模型只能★ 497Magic-MeMagic-Me 是一个基于扩散模型的个性化视频生成项目,旨在实现身份特定的视频定制化生成。它解决了现有文本到视频模型难以保持特定人物身份一致性的问题,允许用户★ 459velocutvelocut 是一个 AI 原生的本地优先视频编辑器,完全在浏览器中运行,由 Ribbi 开发。它采用 Rust/WASM 引擎进行高性能计算,利用 WebG★ 454Video-P2PVideo-P2P 是一个基于 Stable Diffusion 的视频编辑工具,通过控制交叉注意力机制实现文本驱动的视频编辑。它解决了传统视频编辑需要逐帧处理★ 430vynaroVynaro(叙影 AI)是一款基于 Tauri 2、Rust 和 React 19 构建的桌面端 AI 视频创作工具,专注于影视解说与第一人称视角视频的自动化★ 430splicrsplicr(Vynaro 叙影 AI)是一款基于 Tauri 2 + Rust + React 19 构建的桌面端 AI 影视解说与第一人称视频创作工具。它面★ 430supermosh.github.iosupermosh.github.io 是一个基于浏览器的数据破坏(Datamosh)工具,由 TypeScript 编写。它让用户无需安装任何软件,直接在网页★ 370MotionCloneMotionClone 是一个把参考视频转成可编辑动态图形的开源工具,核心思路是借助 Codex 与 ChatGPT 的能力,将视频中的运动、动画节奏和视觉元素★ 344qiaomu-cut-skillqiaomu-cut-skill 是一个面向 AI Agent 的视频导演技能包,基于 Node.js 和 FFmpeg 构建。它解决的是 AI 生成视频时素材★ 338Kiwi-EditKiwi-Edit 是一个统一且完全开源的视频编辑框架,支持通过自然语言指令和参考图像引导视频编辑。它解决了视频编辑中指令理解不准确、编辑控制不精细的问题,核心★ 327