segment-anything
本站收录 25 个带「segment-anything」标签的 AI 开源项目
ultralyticsUltralytics 是计算机视觉领域最流行的开源工具包,提供 YOLO 系列目标检测模型(包括 YOLOv8、YOLO11 及最新的 YOLO26)的一站式★ 62,103
sd-webui-segment-anythingsd-webui-segment-anything 是一个为 Stable Diffusion WebUI 开发的插件,它将 Meta 的 Segment An★ 3,498
anylabelingAnyLabeling 是一款开源的 AI 辅助数据标注工具,目标是让图像标注从纯手工变成半自动甚至自动。它把 YOLO 系列目标检测模型与 Segment A★ 3,491
InternGPTInternGPT(iGPT)是一个开源的AI模型演示平台,旨在让开发者轻松展示和交互体验多种前沿AI模型。它集成了DragGAN、ChatGPT、ImageB★ 3,206
autodistillAutodistill 是一个面向计算机视觉的自动化标注与训练工具,旨在解决监督学习依赖大量人工标注的问题。它利用基础模型(如 GPT-4V、CLIP、Grou★ 2,783
ISAT_with_segment_anythingISAT_with_segment_anything 是一款基于 Segment Anything 系列模型的交互式半自动图像标注工具,用 Python 编写。★ 2,186
awesome-segment-anything这是一个精选资源列表,系统整理了与 Segment Anything 模型(SAM)相关的论文、项目和工具。它解决了 AI 社区中 SAM 生态信息分散、难以追★ 1,702
CVPR2024-Papers-with-Code-Demo这是一个CVPR 2024论文与代码的精选合集,旨在解决计算机视觉领域研究者难以快速获取最新成果和复现资源的问题。项目系统性地整理了CVPR 2024上发表的论★ 1,411
sd-webui-inpaint-anythingsd-webui-inpaint-anything 是一个基于 Stable Diffusion WebUI 的扩展,它将 Segment Anything 的★ 1,295
wunjo.wladradchenko.ruWunjo CE 是一个本地运行的开源多媒体创作工具,集成了人脸替换、唇形同步、视频生成、物体/文字/背景移除、风格重绘、音频分离和声音克隆等多项 AI 能力。★ 1,171
segment-anything-videosegment-anything-video(MetaSeg)是 Meta 的 Segment Anything(SAM)模型的工程化封装版本,主要解决 SAM★ 984
refinersrefiners 是一个基于 PyTorch 的微框架,旨在为基础模型适配提供一流的 API。它解决了扩散模型(如 Stable Diffusion)在微调、适★ 834
keras_cv_attention_modelskeras_cv_attention_models 是一个基于 TensorFlow/Keras 的计算机视觉模型库,汇集了众多主流和前沿的视觉骨干网络,如 B★ 626
samexportersamexporter 是一个专注于将 Segment Anything 系列模型导出为 ONNX 格式的工具,支持 SAM、MobileSAM、Efficie★ 429
awesome-segment-anything-extensions这是一个精选列表,汇集了围绕 Meta 的 Segment Anything Model (SAM) 生态的各类扩展项目、工具和资源。它解决了 SAM 社区资源★ 348
inpaint-anythingInpaint Anything 是一个基于浏览器的图像修复工具,它将 Meta 的 Segment Anything 模型(SAM)与 Stable Diff★ 274
ai_webuiai_webui 是一个面向 AI 创作场景的通用 Web 界面,旨在将图像、音频、视频等 AI 处理能力整合到统一的交互入口中。它解决了多模态 AI 工具分散★ 271
ai-picture-editorai-picture-editor 是一个面向 AI 编程学习的全栈实战项目,用自然语言驱动图像编辑。它把大模型 Agent 能力与 Canvas 画布结合,用★ 263
sd-webui-replacersd-webui-replacer 是一个面向 Stable Diffusion WebUI 的扩展插件,主要解决图像或视频中特定物体的替换问题。它通过检测提示★ 241
Prompt-Can-AnythingPrompt-Can-Anything 是一个基于提示词的 AI 图像处理工具箱,旨在通过自然语言指令驱动多种 SOTA 模型完成图像生成、编辑、检测与分割等任★ 160
Replace-AnythingReplace-Anything 是一个基于 Python 的轻量级 Web 应用,专注于图像局部替换。用户只需上传图片并用文字描述想要替换的区域内容,即可通过★ 115
osamosam 是一个本地运行提示型视觉模型的工具,支持 SAM1、SAM2、SAM3、EfficientSAM、YOLO-World 等模型。它旨在简化这些模型的部★ 96
ShowAnythingShowAnything 是一个基于视觉与语言模型的视频生成与编辑工具,旨在通过自然语言指令或交互式点击,实现对视频中任意目标的精准识别、分割与编辑。它解决了传★ 84
annolidannolid 是一个基于实例分割的多目标跟踪与行为分析工具包,主要面向动物行为研究领域。它解决了研究人员在视频分析中手动标注耗时、难以追踪个体和提取行为特征的★ 59