stable-diffusion-webui-depthmap-script

一键生成高分辨率深度图,让SD图像更有空间感。

这是一个为 Stable Diffusion WebUI 提供高分辨率深度图生成能力的脚本扩展。它解决了 SD WebUI 默认深度估计分辨率低、细节不足的问题,通过集成更先进的深度估计模型,能够为图像生成高质量的深度图。核心能力包括:在 WebUI 界面中直接生成高分辨率深度图,支持多种深度估计模型,并可将深度图用于 ControlNet 等下游任务,以提升图像生成的空间一致性和立体感。该工具特别适合需要精确深度信息来辅助图像编辑、3D 建模或立体显示(如 Looking Glass 光场显示器)的用户。

开源 free 图像生成
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 1855
维护状态 低维护
是否开源
定价模式 free

项目数据

分类图像生成
开发团队thygate
所属国家
官网地址
定价模式free
价格说明开源项目,MIT许可证,完全免费,需自行部署。
访问状态
是否开源
开源协议MIT
主要语言Python
技术栈/模型depthmap,lookingglass,stable-diffusion
GitHub 星标★ 1855
30天Star增速
HF 下载量
上线时间2022-11-03 00:00:00
最近更新2026-09-18 00:00:00
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数2

使用教程

难度:入门 约 10 分钟 部署方式:本地安装 6 步

⚠ 该项目 README 未提供完整安装说明,以下步骤为通用流程,请以官方文档为准。

环境要求

  • 已安装并可正常运行 AUTOMATIC1111 的 Stable Diffusion WebUI
  • Python 环境(随 WebUI 一并安装)
  • 建议有 GPU;显存不足时可用 CPU 计算深度图

安装与启动步骤

  1. 1准备 SD WebUI

    本扩展是 AUTOMATIC1111 Stable Diffusion WebUI 的插件,需先装好 WebUI 并确认能正常启动。

  2. 2安装扩展

    把仓库克隆到 WebUI 的 extensions 目录下即可(README 的安装章节为空,未给出具体安装命令)。

    git clone https://github.com/thygate/stable-diffusion-webui-depthmap-script.git
  3. 3重启 WebUI

    重新启动 WebUI,让扩展被自动加载,之后界面会多出 DepthMap 脚本与 Depth 标签页。

  4. 4选择 DepthMap

    在 txt2img 或 img2img 的 script 选择框里选 DepthMap;处理已有图片则去 Depth 标签页。

  5. 5生成深度图

    在 Model 下拉框选模型(res101、midas 系列、ZoeDepth 系列),可开启 Boost、Match input size 后生成。

  6. 6查看与保存

    勾选 Show DepthMap 才能在网页里看到结果;Save DepthMap 会始终把深度图保存到输出目录。

关键配置

配置项必填说明示例
Maximum wholesize for boost对应 BoostingMonocularDepth 的 r_max,直接决定 Boost 时可能占用的最大显存1600

如何确认成功

启动 WebUI 后,txt2img 的 script 下拉框中出现 DepthMap,或顶部出现 Depth 标签页,即加载成功。

常见问题

Q:开启 Boost 时显存不足怎么办?

A:在 WebUI 设置页调低 Maximum wholesize for boost,或把 Compute on 改为 CPU。默认值已从论文的 3000 降到 1600 以便 8GB 显存可用。

Q:生成后界面看不到深度图?

A:需要勾选 Show DepthMap 才会在页面显示;批量 img2img 时同样要勾选该选项。

Q:为什么生成特别慢?

A:Boost 使用多分辨率合并,计算时间显著增加但效果更好,配 res101 模型效果最佳;生成 3D inpainted 网格则可能从几分钟到一小时。

Q:深度图保存成什么格式?

A:保存为 PNG 时是 16 位单通道;保存成其他格式一律是 8 位三通道 RGB。文件名默认带 _depth 后缀。

注意事项

  • 所有立体图(stereo / anaglyph)生成都在 CPU 上完成,速度受 CPU 影响。
  • Generate 3D inpainted mesh 只在 Depth 标签页可用,生成的 ply 网格和演示视频保存在 extras 目录,视频只能由该扩展生成的网格渲染。
  • 仓库 README 的 Install instructions 章节为空,以上安装方式为通用做法,具体以官方 wiki 为准。

核心亮点

  • 深度图分辨率远高于SD WebUI默认输出,细节更丰富。
  • 集成多种深度估计模型,用户可根据场景灵活选择。
  • 与ControlNet无缝衔接,可提升图像生成的结构一致性。

不足之处

  • 依赖特定模型权重,首次使用需额外下载,增加部署成本。
  • 文档和社区支持相对有限,高级用法需自行摸索。

适用场景

  • 为SD生成图像添加精确深度信息,用于3D建模或立体显示。
  • 配合ControlNet进行结构引导的图像生成,如室内设计、建筑可视化。
  • 用于图像编辑中的前景背景分离或景深效果增强。

替代项目

Stable Diffusion WebUI ControlNet、MiDaS、ZoeDepth

项目介绍

stable-diffusion-webui-depthmap-script 是图像领域的开源项目,由 thygate 开发,2022 年首次发布。

在全站 13,014 个收录项目中,它的 GitHub 星标数(1,855)位列前 30%,在图像分类的 837 个项目里位列前 10%。

项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-18。MIT许可证,完全免费,需自行部署。

它主要面向的使用场景是:为SD生成图像添加精确深度信息,用于3D建模或立体显示。同类可对比的替代方案包括 Stable Diffusion WebUI ControlNet、MiDaS、ZoeDepth。

同类项目推荐

satori 开源

网页代码一键变高清图,放大不糊,不用截图

Enlightened library to convert HTML and CSS to SVG

★ 13967 2026-08-09
C2GAN 开源

用关键点精准控制图像生成,让AI画出你想要的结构

[ACM MM 2019 Oral] Cycle In Cycle Generative Adversarial Networks for Keypoint-Guide···

★ 70 2026-08-09
ComfyUI 开源

像搭积木一样连节点,生图流程自己搭

The most powerful and modular diffusion model GUI, api and backend with a graph/node···

★ 134493 2026-08-09