MVPaint
开源
一张图或一句话,同步生成多视角一致的3D纹理
MVPaint 是一个基于多视角扩散模型的 3D 纹理生成框架,由南洋理工大学等机构在 CVPR 2025 提出。它···
汇聚全球AI图像生成与AI绘画项目,收录Midjourney、Stable Diffusion等工具的多维度数据。
共收录 849 个开源项目
MVPaint
开源
一张图或一句话,同步生成多视角一致的3D纹理
MVPaint 是一个基于多视角扩散模型的 3D 纹理生成框架,由南洋理工大学等机构在 CVPR 2025 提出。它···
VINE
开源
给图像打上编辑不掉的隐形水印,AI 改图也能溯源
VINE 是 ICLR 2025 的官方实现,专注于利用生成式先验(如扩散模型)实现鲁棒图像水印,以抵御现代···
VistaDream
开源
一张图生成多视角一致图像,搞定单视图三维重建
VistaDream 是一个用于单视图场景重建的多视图一致图像采样工具,由 ICCV 2025 论文提出。它解决的···
HiCo_T2I
开源
用布局框精准控制图像生成,告别乱摆乱放
HiCo_T2I 是 NeurIPS 2024 收录的布局条件图像生成项目,旨在解决文本到图像生成中布局控制不精准的···
DiGIT
开源
稳定图像潜空间,让自回归生成更连贯
DiGIT 是一个基于自回归建模的图像生成框架,来自 NeurIPS 2024 论文。它提出通过稳定潜空间来统一···
Meissonic
开源
用掩码生成Transformer,快速产出高清图像
Meissonic 是一个基于掩码生成 Transformer 的高效文本到图像合成模型,由 ICLR 2025 接收。它旨在···
Sana
开源
一句话生成高清大图,放大细节也不糊
NVIDIA 开源的高效高分辨率图像合成模型,采用线性 Diffusion Transformer 架构,在保持高质量生成···
imagine
开源
用图形界面轻松玩转 Flux 图像生成
imagine 是一个基于 TypeScript 构建的图形化界面工具,专注于 Flux 图像生成。它为用户提供了一个···
IterComp
开源
迭代反馈学习,让AI画图更懂复杂指令
IterComp 是一个面向文本到图像生成的开源框架,核心解决复杂组合生成问题(如多物体、属性绑定、空···
cf-flux-remix
开源
免费部署 FLUX.1 图像生成,无需 GPU,一键上 Cloudflare Workers
cf-flux-remix 是一个基于 Cloudflare Workers 和 Workers AI 的免费文本生成图像项目,使用 FLUX.···
flux.swift.cli
开源
终端敲命令,快速用 FLUX.1 生成图片
flux.swift.cli 是一个用 Swift 编写的命令行工具,用于调用 FLUX.1 模型进行文生图。它解决了开发···
maskbit-pytorch
开源
用二进制量化让图像生成更高效,重建更清晰
MaskBit 是字节跳动 AI 提出的图像生成模型,本仓库是其 PyTorch 实现。它基于自编码器与二进制量化···
ImageFolder
开源
把图像切成高效token,让AR/VAR生成又快又好
ImageFolder 是一个面向自回归(AR)和变量自回归(VAR)图像生成模型的高性能图像分词器。它解决了···
一键修复 AI 像素画,让边缘清晰、色彩纯正
proper-pixel-art 是一个专注于修复 AI 生成像素画图像、视频及精灵图上传问题的 Python 工具。它解···
workers-ai-image-playground
开源
在 Cloudflare Workers 上快速实现文本生成图片
这是一个基于 Cloudflare Workers AI 的图像生成演示项目,利用 Workers AI 平台提供的强大文本到图···
CogView4
开源
中文海报文字精准渲染,高分辨率图像一键生成
CogView4 是智谱AI开源的多模态图像生成模型系列,包含 CogView4、CogView3-Plus 和 CogView3(ECC···
OmniGen
开源
一个模型搞定文生图、编辑和多图融合,省心省力。
OmniGen 是一个统一图像生成框架,基于扩散模型,通过单一模型实现文生图、图像编辑、多图融合、角···
textboost
开源
一张图微调文本编码器,让 Stable Diffusion 学会你的专属主体
TextBoost 是一个面向文本到图像模型的个性化微调工具,核心解决单张参考图即可实现主体定制化生成···
Qihoo-T2X
开源
高效DiT架构,让文本生成图像/视频更快更省算力
Qihoo-T2X 是一个基于高效 DiT(Diffusion Transformer)架构的文本到任意内容(text2any)生成项目···
Vec2Face
开源
用松散向量一键生成海量多样人脸数据集,省时省力
Vec2Face 是 ICLR 2025 收录的官方实现,旨在解决人脸数据集生成中的规模与多样性瓶颈。传统方法依···
text-guided-image-colorization
开源
上传图片,指定对象颜色,一键生成彩色图像
这是一个交互式图像着色工具,结合了Stable Diffusion (SDXL)和BLIP模型,并采用ControlNet方法进行···
Perchance-T2I-Desktop
开源
把 Perchance 文生图装进桌面,操作更顺手
Perchance-T2I-Desktop 是一个基于 Perchance 文本生成图像服务的桌面客户端,使用 Vue 和 .NET 构···
Atlas
开源
一键生成无限宇宙,P2P 连接共享你的星系
Atlas 是一个基于 TypeScript 的过程化生成宇宙模拟器,通过 P2P 网络连接,旨在创建广阔而复杂的星···
PhotoPoster
开源
上传姿态,生成逼真人物图像,助力舞蹈动画研究。
PhotoPoster 是一个专注于姿态驱动图像生成的开源项目,旨在推动肖像动画领域的研究。它解决的核心···