grounded-segment-anything-colab

一句话输入,自动检测分割并重绘图像,Colab 免费跑通全流程

这是一个基于 Colab 的交互式笔记本,整合了 Grounding DINO、Segment Anything 和 Stable Diffusion 三大模型,实现从文本描述到图像生成、目标检测、分割及局部重绘的完整流程。用户只需输入文本提示,即可自动检测图像中的目标物体,生成精确的分割掩码,并利用 Stable Diffusion 对指定区域进行内容替换或修复。项目解决了传统图像编辑中需要手动标注区域的痛点,将自然语言理解与像素级分割、生成式填充无缝衔接,降低了多模型组合使用的技术门槛。核心能力包括:开放词汇目标检测、零样本分割、基于文本的局部图像编辑,以及一键在 Google Colab 中运行,无需本地 GPU 配置。适合快速原型验证和教学演示,但项目处于早期阶段,代码结构简单,功能稳定性有待完善。

开源 free 图像生成
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 191
维护状态 低维护
是否开源 是
定价模式 free

项目数据

分类图像生成
开发团队camenduru
所属国家
官网地址
定价模式free
价格说明开源项目,基于Unlicense许可证,完全免费,无付费版本。
访问状态
是否开源是
开源协议Unlicense
主要语言Jupyter Notebook
技术栈/模型colab,colab-notebook,colaboratory,inpaint,inpainting,segment,segmentation,stable-diffusion
GitHub 星标★ 191
30天Star增速
HF 下载量
上线时间2023-04-10 00:00:00
最近更新2026-09-23 00:00:00
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数3

使用教程

核心亮点

  • 整合 Grounding DINO 与 SAM,文本即可驱动精准分割,无需手动标注
  • 结合 Stable Diffusion 实现局部重绘,支持文字描述直接编辑图像
  • Colab 一键运行,零本地环境配置,适合快速体验和教学

不足之处

  • 项目早期,代码注释和文档较少,二次开发难度较高
  • 依赖多个大型模型,Colab 免费版可能内存不足或运行缓慢

适用场景

  • 快速验证文本引导的图像分割与编辑效果
  • 教学演示多模型协同工作流程
  • 作为原型基础,开发自动化图像处理工具

替代项目

Grounded-SAM、Segment Anything、Stable Diffusion WebUI

项目介绍

grounded-segment-anything-colab 是计算机视觉领域的开源项目,由 camenduru 开发,2023 年首次发布。

它收录于计算机视觉分类,该分类目前共有 447 个项目,GitHub 星标数为 191。

项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-23。基于Unlicense许可证,完全免费,无付费版本。

它主要面向的使用场景是:快速验证文本引导的图像分割与编辑效果。同类可对比的替代方案包括 Grounded-SAM、Segment Anything、Stable Diffusion WebUI。

上一篇:SDMatte

下一篇:vivid123

同类项目推荐

modlens 开源

给纯文本编码代理装上眼睛,粘贴图片即刻获得结构化视觉证据。

The first vision plugin for DeepSeek Harness, and the vision bridge for every text-o···

★ 4019 2026-08-19
opencv 开源

开箱即用的视觉算法库,搞定图像视频处理与识别

Open Source Computer Vision Library

★ 90930 2026-08-10
OpenCVTutorials 开源

中文 OpenCV 教程,从入门到实战,边看边跑代码

OpenCV-Python4.1 中文文档

★ 1430 2026-08-20
DEIMv2 开源

用DINOv3做实时检测,又快又准,直接落地。

[DEIMv2] Real Time Object Detection Meets DINOv3

★ 2046 2026-08-14