PromptEnhancer

一键优化提示词,让图像生成更精准、更出彩

PromptEnhancer 是一个提示词重写工具,旨在将用户输入的图像生成提示词优化为更清晰、结构化的版本,从而提升生成图像的质量。它基于视觉语言模型(VLM)技术,支持文本到图像、图像到图像以及图像编辑等多种生成场景。该项目解决了用户因提示词表述模糊、缺乏细节而导致生成效果不佳的问题,通过自动重构提示词,使其包含更具体的对象描述、风格指示和构图要素,帮助用户更精准地控制生成结果。核心能力包括:智能解析用户意图、生成结构化提示词、适配多种生成模型(如混元图像模型)。项目使用 Python 实现,提供了简洁的 API 接口,方便集成到现有工作流中。

开源 unknown 图像生成
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 3776
维护状态 维护中
是否开源 是
定价模式 unknown

项目数据

分类图像生成
开发团队Hunyuan-PromptEnhancer
所属国家
定价模式unknown
价格说明定价信息待确认
访问状态
是否开源是
开源协议NOASSERTION
主要语言Python
技术栈/模型hunyuan,hunyuan-image,image-editing,image-to-image,prompt,prompt-engineering,prompt-enhancer,text-to-image,vlm
GitHub 星标★ 3776
30天Star增速
HF 下载量
上线时间2025-09-09 00:00:00
最近更新2026-09-23 00:00:00
维护状态维护中
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数2

使用教程

难度:入门 约 10 分钟 部署方式:本地安装 5 步

环境要求

  • Python 环境与 pip(README 使用 pip install 安装依赖)
  • 能访问 GitHub 与 Hugging Face 下载代码和模型权重
  • 使用 GGUF 量化推理时需要 CUDA 支持的显卡环境
  • 本地磁盘空间用于存放 7B/32B 模型文件

安装与启动步骤

  1. 1获取项目代码

    从官方仓库克隆代码到本地,后续所有命令都在项目根目录执行。

    git clone https://github.com/Hunyuan-PromptEnhancer/PromptEnhancer
    cd PromptEnhancer
  2. 2安装标准依赖

    README 推荐的标准安装方式,按 requirements.txt 一次性装好全部 Python 依赖。

    pip install -r requirements.txt
  3. 3可选:GGUF 安装

    需要更低显存、更快推理(尤其 32B 模型)时改用此方式,脚本会自动加执行权限并安装。

    chmod +x script/install_gguf.sh && ./script/install_gguf.sh
  4. 4准备模型文件

    把下载的模型权重放到项目 models/ 目录,推理脚本会自动检测该目录下的模型。README 未给出下载命令,请自行从官方模型页获取。

  5. 5运行命令行推理

    执行 GGUF 命令行脚本,自动读取 models/ 目录模型,输入提示词后得到重写后的结构化提示词。

    python inference/prompt_enhancer_gguf.py

如何确认成功

运行 inference/prompt_enhancer_gguf.py 后终端正常输出重写后的提示词,且未报找不到模型或依赖缺失的错误。

常见问题

Q:7B 和 32B 模型该怎么选?

A:多数用户建议先用 PromptEnhancer-7B,显存占用更低;图像编辑/图生图场景需要 32B 模型。

Q:显存不够或推理太慢怎么办?

A:改用 GGUF 安装方式(Option 2),量化模型推理更快、内存占用更低,对 32B 尤其明显。

Q:支持图生图和图像编辑吗?

A:支持。文本生图用 HunyuanPromptEnhancer 或 PromptEnhancerGGUF,图像编辑用 PromptEnhancerImg2Img。

Q:模型要放在哪里?

A:放在项目根目录的 models/ 文件夹下,命令行脚本会自动检测,无需额外指定路径。

注意事项

  • GGUF 安装方式需要 CUDA 支持,纯 CPU 环境请选标准安装。
  • README 未提供模型权重的下载命令,需自行从 Hugging Face 官方页面获取后放入 models/ 目录。
  • 图像编辑/图生图任务只支持 32B 模型,7B 仅适用于纯文本生图提示词增强。

核心亮点

  • 基于 VLM 的智能重写,能捕捉用户意图并生成结构化提示词,显著提升生成图像与描述的匹配度
  • 支持多种图像生成模式(文生图、图生图、图像编辑),适用范围广
  • 代码简洁,API 设计清晰,易于集成到现有 Python 项目中

不足之处

  • 依赖外部 VLM 模型,推理耗时和成本可能较高
  • 文档/社区待观察

适用场景

  • 设计师快速生成概念图,需要将模糊想法转化为精确提示词
  • 开发者构建图像生成应用,希望提升用户输入提示词的质量
  • 研究者进行提示词工程实验,需要批量优化提示词以对比生成效果

替代项目

PromptPerfect、Promptist、MagicPrompt

项目介绍

PromptEnhancer 是图像领域的开源项目,由 Hunyuan-PromptEnhancer 开发,2025 年首次发布。

在全站 13,090 个收录项目中,它的 GitHub 星标数(3,776)位列前 30%,在图像分类的 839 个项目里位列前 7%。

近 42 天,它的 GitHub 星标从 3,751 增加到 3,776,净增 25。

项目仍在小幅维护中,最近一次代码更新于 2026-09-23。从国内网络环境看,可直接访问。

它主要面向的使用场景是:设计师快速生成概念图,需要将模糊想法转化为精确提示词。同类可对比的替代方案包括 PromptPerfect、Promptist、MagicPrompt。

上一篇:deep-daze

下一篇:min-dalle

同类项目推荐

satori 开源

网页代码一键变高清图,放大不糊,不用截图

Enlightened library to convert HTML and CSS to SVG

★ 13967 2026-08-09
C2GAN 开源

用关键点精准控制图像生成,让AI画出你想要的结构

[ACM MM 2019 Oral] Cycle In Cycle Generative Adversarial Networks for Keypoint-Guide···

★ 70 2026-08-09
ComfyUI 开源

像搭积木一样连节点,生图流程自己搭

The most powerful and modular diffusion model GUI, api and backend with a graph/node···

★ 134493 2026-08-09