Ground-A-Video

用一句话描述,让视频编辑像改图一样简单

Ground-A-Video 是一个基于扩散模型的零样本视频编辑工具,来自 ICLR 2024 论文。它解决了传统视频编辑需要逐帧处理、难以保持时空一致性的痛点,利用文本到图像扩散模型的强大生成能力,实现无需额外训练的视频编辑。核心能力包括:通过文本提示词精准控制编辑内容,支持对视频中特定对象进行替换、修改或添加,同时保持背景和运动轨迹的稳定性。项目提供了完整的推理代码和预训练模型,用户可以通过简单的命令行操作完成视频编辑。其创新点在于将空间注意力机制与时间一致性约束相结合,使得编辑后的视频在帧间过渡自然,避免了闪烁和变形问题。

开源 free 图像生成
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 140
维护状态 低维护
是否开源 是
定价模式 free

项目数据

分类图像生成
开发团队Ground-A-Video
所属国家
定价模式free
价格说明开源项目,提供在线演示页面,可免费使用,无付费版本。
访问状态
是否开源是
开源协议
主要语言Python
技术栈/模型computer-vision,diffusion-models,iclr,stable-diffusion,text-to-video,video-editing
GitHub 星标★ 140
30天Star增速
HF 下载量
上线时间2023-09-19 00:00:00
最近更新2025-11-19 00:00:00
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数1

使用教程

核心亮点

  • 零样本编辑,无需针对每个视频重新训练模型,开箱即用
  • 基于 Stable Diffusion,文本提示控制精准,编辑效果自然
  • 提供完整推理代码和预训练权重,易于复现和二次开发

不足之处

  • 项目处于早期,文档和社区支持相对薄弱,遇到问题可能难以及时解决
  • 对输入视频的分辨率和长度有一定限制,编辑耗时较长

适用场景

  • 影视后期:快速替换视频中的物体或人物,减少逐帧修图工作量
  • 内容创作:为短视频添加创意元素,如给天空加上飞龙
  • 广告制作:根据文案自动调整视频中的商品或场景

替代项目

Runway Gen-2、Pika Labs、Text2Video-Zero

项目介绍

Ground-A-Video 是视频领域的开源项目,由 Ground-A-Video 开发,2023 年首次发布。

它收录于视频分类,该分类目前共有 473 个项目,GitHub 星标数为 140。

项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2025-11-19。提供在线演示页面,可免费使用,无付费版本。从国内网络环境看,可直接访问。

它主要面向的使用场景是:影视后期:快速替换视频中的物体或人物,减少逐帧修图工作量。同类可对比的替代方案包括 Runway Gen-2、Pika Labs、Text2Video-Zero。

上一篇:VisionCrafter

下一篇:ZoomVideoComposer

同类项目推荐

MoneyPrinterTurbo 开源

输入一句话,高清短视频自动出炉,文案配音全包了

利用 AI 大模型和自动化工作流,根据主题或关键词一键生成高清短视频。Generate HD short ···

★ 125106 2026-08-09
seedance-2.0-api 开源

快速上手字节Seedance 2.0,文本/图片一键生成视频

Seedance 2.0 API — text-to-video and image-to-video examples

★ 332 2026-08-26
openscreen 开源

免费无水印录屏做演示,替代 Screen Studio

Record your screen, ship a demo. Free and open-source, GPU-accelerated, no watermark···

★ 3185 2026-08-10
MagicDance 开源

一张图+任意动作,生成身份不变的逼真人物视频

[ICML 2024] MagicPose(also known as MagicDance): Realistic Human Poses and Facial Ex···

★ 777 2026-08-09