inpainting

本站收录 47 个带「inpainting」标签的 AI 开源项目

InvokeAI面向 Stable Diffusion 模型的领先创意引擎,服务专业设计师、艺术家与爱好者,提供业界一流的 WebUI 与最新的 AI 视觉生成技术,让从灵感到★ 28,313IOPaint基于 SOTA AI 模型的图像修复工具,可一键移除照片中任何不想要的物体、瑕疵或人物,支持擦除与替换(由 Stable Diffusion 驱动),本地部署即★ 23,313manga-image-translatormanga-image-translator 是一个基于深度学习的漫画/图片文字翻译工具,能够自动检测图片中的文字区域,识别原文(主要支持日文、英文等),并翻译★ 10,454mmagicOpenMMLab 推出的多模态生成智能创作工具箱,提供开箱即用的 AIGC 能力、易用 API 与丰富模型库,涵盖文生图、图像/视频修复与增强等任务,是搭建生★ 7,470BallonsTranslatorBallonsTranslator 是一款深度学习辅助的漫画翻译工具,主要解决漫画本地化过程中人工成本高、流程繁琐的问题。它集成了从文字检测、识别、抹除到翻译、★ 5,164stablediffusion-infinityStable Diffusion Infinity 是一个基于 Stable Diffusion 的无限画布外绘(outpainting)工具,允许用户在生成图★ 3,889local-dreamlocal-dream 是一个在 Android 设备上本地运行 Stable Diffusion 的开源项目,利用高通骁龙平台的 NPU(神经网络处理单元)进★ 3,556comic-translatecomic-translate 是一个开源的 AI 漫画与图像翻译工具,支持浏览器扩展和桌面应用,可自动翻译漫画、韩漫、日漫、欧美漫画等多种图像格式(如图片、P★ 2,957Kandinsky-2Kandinsky-2 是一个多语言文本生成图像(text2image)的潜在扩散模型,由俄罗斯团队开发。它解决了现有文本到图像模型对英文支持良好但多语言能力不★ 2,811awesome-diffusion-categorized这是一个精选扩散模型论文的合集,按子领域分类整理,旨在帮助研究者和开发者快速定位特定方向的学术资源。项目解决了扩散模型论文数量庞大、检索困难的问题,通过系统化的★ 2,224carefree-creatorcarefree-creator 是一个基于 Stable Diffusion 的 AI 图像生成与编辑工具,主打无限画布上的自由创作。它解决了传统图像生成工具★ 1,936awesome-segment-anything这是一个精选资源列表,系统整理了与 Segment Anything 模型(SAM)相关的论文、项目和工具。它解决了 AI 社区中 SAM 生态信息分散、难以追★ 1,702LanPaintLanPaint 是一个面向 Stable Diffusion 系列模型的免训练图像修复(inpainting)方案,同时提供 ComfyUI 自定义节点。它要★ 1,416sd-webui-inpaint-anythingsd-webui-inpaint-anything 是一个基于 Stable Diffusion WebUI 的扩展,它将 Segment Anything 的★ 1,295comfyui-inpaint-nodescomfyui-inpaint-nodes 是一组专为 ComfyUI 设计的图像修复(inpainting)与扩展(outpainting)节点工具。它解决了★ 1,243stable-diffusion-dockerstable-diffusion-docker 是一个将官方 Stable Diffusion 模型封装进 Docker 容器的项目,旨在简化 Stable D★ 743flash-diffusionFlash Diffusion 是一个加速条件扩散模型推理的开源项目,来自 AAAI 2025 Oral 论文。它通过引入先进的蒸馏技术和架构优化,显著减少扩散★ 667ComfyUI-IDM-VTONComfyUI-IDM-VTON 是 IDM-VTON 虚拟试穿模型的 ComfyUI 适配节点,让用户能在 ComfyUI 的可视化节点工作流中直接使用该模型★ 594MangaTranslatorMangaTranslator 是一个用 Python 编写的开源漫画翻译应用,目标是把日漫、韩漫、国漫等图片中的对话自动翻译成目标语言。它把整条流水线串起来:★ 331g-diffuser-botg-diffuser-bot 是一个基于 Python 的 Discord 机器人,为 Stable Diffusion 提供交互界面。它解决了在 Discor★ 282inpaint-anythingInpaint Anything 是一个基于浏览器的图像修复工具,它将 Meta 的 Segment Anything 模型(SAM)与 Stable Diff★ 274ai_webuiai_webui 是一个面向 AI 创作场景的通用 Web 界面,旨在将图像、音频、视频等 AI 处理能力整合到统一的交互入口中。它解决了多模态 AI 工具分散★ 271ai-picture-editorai-picture-editor 是一个面向 AI 编程学习的全栈实战项目,用自然语言驱动图像编辑。它把大模型 Agent 能力与 Canvas 画布结合,用★ 263sd-webui-replacersd-webui-replacer 是一个面向 Stable Diffusion WebUI 的扩展插件,主要解决图像或视频中特定物体的替换问题。它通过检测提示★ 241OnnxStackOnnxStack 是一个基于 C# 和 ONNX Runtime 的 Stable Diffusion 推理框架,旨在为 .NET 开发者提供原生、高效的图像★ 238Stable-Diffusion-Latent-Space-ExplorerStable-Diffusion-Latent-Space-Explorer 是一个基于 diffusers 库的 Stable Diffusion 实验工具箱★ 228MooshieUIMooshieUI 是一个面向 ComfyUI 的桌面前端界面,专为初学者设计。它解决了 ComfyUI 原生节点式界面复杂难懂的问题,将底层工作流封装成直观的★ 203grounded-segment-anything-colab这是一个基于 Colab 的交互式笔记本,整合了 Grounding DINO、Segment Anything 和 Stable Diffusion 三大模型★ 191GhostCut-auto_video_translationGhostCut-auto_video_translation 是一个基于 Python 的自动视频翻译与配音工具,主要解决视频硬字幕翻译、去除与重配音的痛点。★ 173ConffusionConffusion 是论文《Conffusion: Confidence Intervals for Diffusion Models》的官方实现,旨在为扩散★ 143Replace-AnythingReplace-Anything 是一个基于 Python 的轻量级 Web 应用,专注于图像局部替换。用户只需上传图片并用文字描述想要替换的区域内容,即可通过★ 115yasd-discord-botyasd-discord-bot 是一个基于 Python 的 Discord 机器人,旨在将 Stable Diffusion 图像生成能力无缝集成到 Dis★ 110comic-localizercomic-localizer 是一个用 Python 编写的漫画本地化工具,面向需要将外语漫画快速翻译成中文的读者和汉化组。它把 OCR 文字识别、机器翻译、★ 108AI_Image_Translator_Translate_Images这是一个面向图片文字的 AI 翻译工具,主要解决跨境电商、海报、商品图、封面横幅等场景下图片内文字需要翻译的问题。传统做法是人工抠图、擦除原文、重新排版,费时费★ 107CLIPAwayCLIPAway 是 NeurIPS 2024 收录的官方实现,专注于基于扩散模型的图像编辑,特别是物体移除与背景填充任务。它利用 CLIP 模型的多模态理解能★ 106ComfyUI-Forbidden-VisionComfyUI-Forbidden-Vision 是一个为 ComfyUI 设计的图像处理插件,专注于人脸检测、分割与增强。它通过自定义训练的模型,解决了在动漫★ 102sd-webui-lama-cleaner-masked-content这是一个 Stable Diffusion WebUI 的扩展插件,核心功能是在图生图(Inpainting)之前,先用 LAMA Cleaner 对蒙版区域进★ 102StereoDiffusionStereoDiffusion 是一个基于 Stable Diffusion 的立体图像生成工具,通过扩散模型直接生成具有双目视差的立体图像对,无需复杂的后期处★ 97DiffRollDiffRoll 是一个基于扩散模型的自动音乐转录(AMT)开源项目,采用 PyTorch 实现。它解决的是将音频信号转换为符号化音乐表示(如钢琴卷帘)的问题,★ 82Simple-LoraSimple-Lora 是一个面向中文用户的扩散模型 LoRA 训练教程项目,专注于虚拟偶像(虚拟idol)的定制化训练。它解决了中文社区在 Stable Di★ 81stable_diffusion_dreambooth_inpainting这是一个基于Stable Diffusion的Dreambooth与Inpainting微调项目,旨在解决特定对象或场景的图像生成与局部修复问题。它结合了Dre★ 67NAI-Utility-ToolNAI-Utility-Tool 是一个面向 NovelAI API 的前端工具,基于 C# 和 WinUI3 构建,采用 Fluent Design 风格,提★ 66comfyui-workflow-versatile这是一个通用的 ComfyUI 工作流模板,旨在覆盖常见的图像生成需求。它解决了 ComfyUI 用户从零搭建复杂工作流的痛点,将文生图、图生图、局部重绘、扩图★ 63spellcasterspellcaster 是一个专注于本地 AI 图像生成的开源工具,旨在提供无痛、专业、私密且免费的使用体验。它主要解决用户在本地环境中运行 AI 图像生成时面★ 60amodalAmodal是CVPR 2024 Highlight论文《Amodal Completion via Progressive Mixed Context Dif★ 56Image-AI-Generator-2026Image-AI-Generator-2026 是一款桌面端 AI 图像生成工具,旨在让创作者快速产出高质量的艺术作品、照片级渲染和创意概念。它基于扩散模型和深★ 53LightDiffusion-NextLightDiffusion-Next 是一个专注于扩散模型推理性能优化的开源项目,旨在提供最快的 Diffusion 后端、WebUI 和服务器。它解决的是扩★ 51