YoChameleon

上传一张照片,生成你主演的各种场景图

YoChameleon 是一个 CVPR 2025 开源项目,旨在实现个性化图像生成中的身份保持与编辑。它解决的是在文本到图像生成模型中,如何将特定人物(或物体)的身份特征稳定地迁移到新生成图像中的问题,同时保持对背景、姿态、表情等属性的灵活控制。其核心能力包括:基于参考图像提取身份特征,并通过轻量级适配器注入到预训练扩散模型(如 Stable Diffusion)中,实现无需微调的一次性个性化生成;支持多参考图像融合,提升身份保真度;支持与 ControlNet 等工具结合,实现精细的结构控制。项目提供完整的训练和推理代码,以及预训练模型权重,方便研究者复现和二次开发。

开源 free 开源模型
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 151
维护状态 低维护
是否开源 是
定价模式 free

项目数据

分类开源模型
开发团队WisconsinAIVision
所属国家
定价模式free
价格说明开源项目,可自行部署使用,无收费信息。
访问状态
是否开源是
开源协议NOASSERTION
主要语言Python
技术栈/模型chameleon,cvpr,cvpr2025,large-language-models,large-multimodal-models,llms,lmms,personalization,personalized,personalized-generation
GitHub 星标★ 151
30天Star增速
HF 下载量
上线时间2024-07-15 00:00:00
最近更新2026-05-03 00:00:00
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数2

使用教程

核心亮点

  • 身份保持效果好,能生成多视角、多表情的同一人物
  • 支持多参考图融合,提升生成稳定性和相似度
  • 代码结构清晰,基于主流扩散模型,易于扩展

不足之处

  • 项目处于早期,文档和社区支持待观察
  • 对硬件要求较高,推理和训练需要较大显存

适用场景

  • 个人头像和写真生成
  • 虚拟试衣或商品模特替换
  • 影视预可视化或游戏角色概念设计

替代项目

IP-Adapter、PhotoMaker、InstantID

项目介绍

YoChameleon 是计算机视觉领域的开源项目,由 WisconsinAIVision 开发,2024 年首次发布。

它收录于计算机视觉分类,该分类目前共有 447 个项目,GitHub 星标数为 151。

项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-05-03。可自行部署使用,无收费信息。

它主要面向的使用场景是:个人头像和写真生成。同类可对比的替代方案包括 IP-Adapter、PhotoMaker、InstantID。

上一篇:VLM-Grounder

下一篇:Flipped-VQA

同类项目推荐

modlens 开源

给纯文本编码代理装上眼睛,粘贴图片即刻获得结构化视觉证据。

The first vision plugin for DeepSeek Harness, and the vision bridge for every text-o···

★ 4019 2026-08-19
opencv 开源

开箱即用的视觉算法库,搞定图像视频处理与识别

Open Source Computer Vision Library

★ 90930 2026-08-10
OpenCVTutorials 开源

中文 OpenCV 教程,从入门到实战,边看边跑代码

OpenCV-Python4.1 中文文档

★ 1430 2026-08-20
DEIMv2 开源

用DINOv3做实时检测,又快又准,直接落地。

[DEIMv2] Real Time Object Detection Meets DINOv3

★ 2046 2026-08-14