图像

汇聚全球AI图像生成与AI绘画项目,收录Midjourney、Stable Diffusion等工具的多维度数据。

共收录 849 个开源项目

MVPaint 开源

一张图或一句话,同步生成多视角一致的3D纹理

MVPaint 是一个基于多视角扩散模型的 3D 纹理生成框架,由南洋理工大学等机构在 CVPR 2025 提出。它···

★ 262 评分 2024-10-30
VINE 开源

给图像打上编辑不掉的隐形水印,AI 改图也能溯源

VINE 是 ICLR 2025 的官方实现,专注于利用生成式先验(如扩散模型)实现鲁棒图像水印,以抵御现代···

★ 390 评分 2024-10-21
VistaDream 开源

一张图生成多视角一致图像,搞定单视图三维重建

VistaDream 是一个用于单视图场景重建的多视图一致图像采样工具,由 ICCV 2025 论文提出。它解决的···

★ 542 评分 2024-10-21
HiCo_T2I 开源

用布局框精准控制图像生成,告别乱摆乱放

HiCo_T2I 是 NeurIPS 2024 收录的布局条件图像生成项目,旨在解决文本到图像生成中布局控制不精准的···

★ 66 评分 2024-10-17
DiGIT 开源

稳定图像潜空间,让自回归生成更连贯

DiGIT 是一个基于自回归建模的图像生成框架,来自 NeurIPS 2024 论文。它提出通过稳定潜空间来统一···

★ 78 评分 2024-10-15
Meissonic 开源

用掩码生成Transformer,快速产出高清图像

Meissonic 是一个基于掩码生成 Transformer 的高效文本到图像合成模型,由 ICLR 2025 接收。它旨在···

★ 347 评分 2024-10-13
Sana 开源

一句话生成高清大图,放大细节也不糊

NVIDIA 开源的高效高分辨率图像合成模型,采用线性 Diffusion Transformer 架构,在保持高质量生成···

★ 9146 评分 2024-10-11
imagine 开源

用图形界面轻松玩转 Flux 图像生成

imagine 是一个基于 TypeScript 构建的图形化界面工具,专注于 Flux 图像生成。它为用户提供了一个···

★ 56 评分 2024-10-10
IterComp 开源

迭代反馈学习,让AI画图更懂复杂指令

IterComp 是一个面向文本到图像生成的开源框架,核心解决复杂组合生成问题(如多物体、属性绑定、空···

★ 202 评分 2024-10-09
cf-flux-remix 开源

免费部署 FLUX.1 图像生成,无需 GPU,一键上 Cloudflare Workers

cf-flux-remix 是一个基于 Cloudflare Workers 和 Workers AI 的免费文本生成图像项目,使用 FLUX.···

★ 120 评分 2024-10-08
flux.swift.cli 开源

终端敲命令,快速用 FLUX.1 生成图片

flux.swift.cli 是一个用 Swift 编写的命令行工具,用于调用 FLUX.1 模型进行文生图。它解决了开发···

★ 68 评分 2024-10-08
maskbit-pytorch 开源

用二进制量化让图像生成更高效,重建更清晰

MaskBit 是字节跳动 AI 提出的图像生成模型,本仓库是其 PyTorch 实现。它基于自编码器与二进制量化···

★ 82 评分 2024-10-07
ImageFolder 开源

把图像切成高效token,让AR/VAR生成又快又好

ImageFolder 是一个面向自回归(AR)和变量自回归(VAR)图像生成模型的高性能图像分词器。它解决了···

★ 307 评分 2024-09-29
proper-pixel-art 开源

一键修复 AI 像素画,让边缘清晰、色彩纯正

proper-pixel-art 是一个专注于修复 AI 生成像素画图像、视频及精灵图上传问题的 Python 工具。它解···

★ 542 评分 2024-09-27
workers-ai-image-playground 开源

在 Cloudflare Workers 上快速实现文本生成图片

这是一个基于 Cloudflare Workers AI 的图像生成演示项目,利用 Workers AI 平台提供的强大文本到图···

★ 71 评分 2024-09-26
CogView4 开源

中文海报文字精准渲染,高分辨率图像一键生成

CogView4 是智谱AI开源的多模态图像生成模型系列,包含 CogView4、CogView3-Plus 和 CogView3(ECC···

★ 1099 评分 2024-09-23
OmniGen 开源

一个模型搞定文生图、编辑和多图融合,省心省力。

OmniGen 是一个统一图像生成框架,基于扩散模型,通过单一模型实现文生图、图像编辑、多图融合、角···

★ 4343 评分 2024-09-16
textboost 开源

一张图微调文本编码器,让 Stable Diffusion 学会你的专属主体

TextBoost 是一个面向文本到图像模型的个性化微调工具,核心解决单张参考图即可实现主体定制化生成···

★ 56 评分 2024-09-12
Qihoo-T2X 开源

高效DiT架构,让文本生成图像/视频更快更省算力

Qihoo-T2X 是一个基于高效 DiT(Diffusion Transformer)架构的文本到任意内容(text2any)生成项目···

★ 446 评分 2024-09-05
Vec2Face 开源

用松散向量一键生成海量多样人脸数据集,省时省力

Vec2Face 是 ICLR 2025 收录的官方实现,旨在解决人脸数据集生成中的规模与多样性瓶颈。传统方法依···

★ 91 评分 2024-08-31
text-guided-image-colorization 开源

上传图片,指定对象颜色,一键生成彩色图像

这是一个交互式图像着色工具,结合了Stable Diffusion (SDXL)和BLIP模型,并采用ControlNet方法进行···

★ 108 评分 2024-08-30
Perchance-T2I-Desktop 开源

把 Perchance 文生图装进桌面,操作更顺手

Perchance-T2I-Desktop 是一个基于 Perchance 文本生成图像服务的桌面客户端,使用 Vue 和 .NET 构···

★ 58 评分 2024-08-22
Atlas 开源

一键生成无限宇宙,P2P 连接共享你的星系

Atlas 是一个基于 TypeScript 的过程化生成宇宙模拟器,通过 P2P 网络连接,旨在创建广阔而复杂的星···

★ 63 评分 2024-08-21
PhotoPoster 开源

上传姿态,生成逼真人物图像,助力舞蹈动画研究。

PhotoPoster 是一个专注于姿态驱动图像生成的开源项目,旨在推动肖像动画领域的研究。它解决的核心···

★ 210 评分 2024-08-21