ladi-vton 是计算机视觉领域的开源项目,由 miccunifi 开发,2023 年首次发布。
它收录于计算机视觉分类,该分类目前共有 447 个项目,GitHub 星标数为 465。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-08-30。本地部署,完全免费。
它主要面向的使用场景是:电商平台虚拟试穿功能。同类可对比的替代方案包括 VITON-HD、DCI-VTON、OOTDiffusion。

上传衣服和模特图,AI 生成自然逼真的试穿效果
LaDI-VTON 是一个基于潜在扩散模型(Latent Diffusion)的虚拟试穿项目,发表于 ACM MM 2023。它解决传统虚拟试穿中服装细节丢失、纹理模糊的问题,通过文本反演(Textual Inversion)技术将服装视觉特征编码为文本嵌入,从而在不依赖额外条件分支的情况下,将服装迁移到目标人物身上。核心能力包括:支持多类别服装(上衣、下装、连衣裙)的试穿,利用预训练的 Stable Diffusion 模型进行生成,并通过注意力机制和掩码策略保留人物身份与姿态。项目提供了完整的训练和推理代码,支持 DressCode 和 FashionAI 数据集,适合学术研究和应用开发。
VITON-HD、DCI-VTON、OOTDiffusion
ladi-vton 是计算机视觉领域的开源项目,由 miccunifi 开发,2023 年首次发布。
它收录于计算机视觉分类,该分类目前共有 447 个项目,GitHub 星标数为 465。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-08-30。本地部署,完全免费。
它主要面向的使用场景是:电商平台虚拟试穿功能。同类可对比的替代方案包括 VITON-HD、DCI-VTON、OOTDiffusion。
上一篇:ComfyUI-YoloWorld-EfficientSAM
下一篇:gen-cv
modlens
开源
给纯文本编码代理装上眼睛,粘贴图片即刻获得结构化视觉证据。
The first vision plugin for DeepSeek Harness, and the vision bridge for every text-o···
opencv
开源
开箱即用的视觉算法库,搞定图像视频处理与识别
Open Source Computer Vision Library
OpenCVTutorials
开源
中文 OpenCV 教程,从入门到实战,边看边跑代码
OpenCV-Python4.1 中文文档
DEIMv2
开源
用DINOv3做实时检测,又快又准,直接落地。
[DEIMv2] Real Time Object Detection Meets DINOv3