flux

本站收录 70 个带「flux」标签的 AI 开源项目(按 GitHub 星标从高到低,此处展示前 50 个)

OpenMontage全球首个开源的智能体视频制作系统,提供 12 条生产流水线、100 余种工具以及 700 多个智能体技能与制作知识文件。可将 AI 编程助手转化为完整的视频生产★ 61,862diffusersHugging Face 官方出品的扩散模型工具库,基于 PyTorch,提供图像、视频、音频生成领域最先进的扩散模型,接口统一、开箱即用,是研究与生产环境中最★ 34,633fast-stable-diffusionfast-stable-diffusion 是一个专注于加速 Stable Diffusion 图像生成与 DreamBooth 微调的开源工具集,主要面向 A★ 7,911stable-diffusion.cpp纯 C/C++ 实现的扩散模型推理库,无需 Python 环境即可运行 SD、Flux、Wan、Qwen Image、Z-Image 等主流模型,性能卓越、部署★ 7,469jaazjaaz 是一个开源的本地多模态创意助手,旨在替代 Canva 和 Manus,同时优先保护用户隐私。它基于 TypeScript 构建,整合了 agent、A★ 6,675remove-ai-watermarks这是一个用于移除AI生成图像水印的命令行工具和Python库,主要针对Google Gemini(Nano Banana)的可见星标水印、SynthID隐形水印★ 5,716ComfyUI-CopilotComfyUI-Copilot 是一个为 ComfyUI 设计的 AI 驱动自定义节点,旨在提升工作流自动化水平并提供智能辅助。它解决的是 ComfyUI 用户★ 5,532nunchakununchaku 是 ICML 2025 Spotlight 论文 SVDQuant 的官方开源实现,专注于 4-bit 扩散模型的量化推理与微调。它通过低秩组★ 3,958InfiniteYouInfiniteYou 是一个基于扩散模型的图像生成与编辑工具,核心解决身份保持下的灵活照片重绘问题。它允许用户在不丢失人物身份特征的前提下,对照片进行多种编辑★ 2,683sd-pppsd-ppp 是一款为 Adobe Photoshop 打造的 AI 插件,旨在将 Stable Diffusion 等先进图像生成模型无缝集成到设计师的日常工★ 2,173locally-uncensoredLocally Uncensored 是一个即插即用的本地 AI 工作室,旨在解决云端 AI 的隐私泄露和内容审查问题。它集成了无审查的聊天、图像生成、视频生成★ 1,847UNOUNO 是一个基于扩散 Transformer 的图像生成定制化方法,由清华大学提出,论文发表于 ICCV 2025。它解决的是当前定制化生成模型只能处理单主体★ 1,363binioubiniou 是一个自托管的 WebUI,聚合了 30 多种生成式 AI 模型,覆盖图像、音频、视频等模态。它基于 Gradio 构建,集成 Hugging F★ 1,151comfyui-mcpComfyUI-MCP 是一个本地优先、面向智能体的 ComfyUI 控制平面,包含 MCP 服务器和侧边栏智能体。它解决了 ComfyUI 操作门槛高、工作流★ 774ComfyUI-IF_AI_toolsComfyUI-IF_AI_tools 是一组为 ComfyUI 设计的自定义节点,通过 Ollama 调用本地大语言模型(LLM)来生成和优化图像生成提示词。★ 700ComfyUI-DyPEComfyUI-DyPE 是为 ComfyUI 提供 DyPE 与 SEGA 两种采样增强技术的自定义节点插件,目标是让文生图模型在 4K 及以上分辨率下生成时★ 627Awesome-DiT-InferenceAwesome-DiT-Inference 是一个精选的扩散模型推理加速论文与代码资源列表,专注于 DiT(Diffusion Transformer)架构。它★ 592ComfyUI-disty-FlowComfyUI-disty-Flow 是一个为 ComfyUI 设计的自定义节点,旨在提供更友好的用户界面,帮助用户更直观地构建和管理图像生成工作流。它解决了 ★ 576comfyUI-Realtime-Lora这是一个 ComfyUI 的插件,让你直接在 ComfyUI 界面里训练、编辑和保存 LoRA 模型,无需切换到外部训练工具。它支持多种基础模型,包括 Z-im★ 566Awesome-Controllable-Diffusion这是一个聚焦扩散模型可控生成的精选资源列表,收录了ControlNet、DreamBooth、IP-Adapter等前沿方法的论文与代码。它系统梳理了从结构控制★ 504FizgigFizgig 是一个面向 Krea 2 和 Flux 2 Klein 9B 模型的 LoRA 训练与工具集,专注于 LoKR(一种低秩适配变体)的完整生命周期管★ 432ComfyUI_Skills_OpenClawComfyUI_Skills_OpenClaw 是一个将 ComfyUI 工作流转化为 AI 智能体可调用技能的开源项目。它解决了 AI 智能体(如 OpenC★ 411diffusers-torchaodiffusers-torchao 是一个专注于扩散模型优化的端到端配方库,由 Hugging Face 和 PyTorch 团队联合维护。它解决的是扩散模型(★ 399flux-kreaflux-krea 是 FLUX.1 Krea [dev] 模型的官方 GitHub 仓库,基于扩散模型架构,专注于文本到图像的生成任务。该项目解决了高质量、高★ 368mlx-openai-servermlx-openai-server 是一个面向 Apple Silicon 芯片的高性能 API 服务器,为 MLX 系列模型提供 OpenAI 兼容的接口。它★ 362DyPEDyPE 是 ICML 2026 论文的官方实现,针对扩散模型在超高分辨率图像生成中的位置编码外推难题,提出动态位置外推方法。现有模型(如 Flux)在训练分辨★ 361img-promptimg-prompt 是一个极简的 AI 图像提示词编辑器,内置 5000+ 提示词模板,支持 18 种语言,帮助用户用母语快速生成适用于 Midjourney★ 360ZenCtrlZenCtrl 是一个基于扩散模型的图像生成工具,专注于上下文驱动的主题生成,同时保持前景保真度。它解决了在图像编辑和生成中,用户希望将特定主体(如人物、物体)★ 352sdk这是一个面向视频生成场景的TypeScript SDK,核心思路是用JSX语法来声明式地描述视频内容,然后通过统一API接入Kling、Flux、ElevenL★ 340AI-Influencer-GeneratorAI-Influencer-Generator 是一个基于 Jupyter Notebook 的开源项目,旨在帮助用户创建和定制虚拟 AI 网红。它利用 Flu★ 313ComfyUI_InfiniteYouInfiniteYou 是一个基于 FLUX 的身份保持图像生成与编辑项目,荣获 ICCV 2025 Highlight。它通过 ComfyUI 原生节点集成,★ 299FireFlow-Fast-Inversion-of-Rectified-Flow-for-Image-Semantic-EditingFireFlow 是一个针对 FLUX-dev 模型的图像语义编辑加速方案,核心创新在于将传统需要数十步的扩散模型反演和编辑过程压缩至各 8 步,实现约 3 倍★ 295daihuo-jianshoudaihuo-jianshou 是一个开源的电商带货短视频自动生成工具,主要解决中小商家和内容创作者制作带货视频耗时费力的问题。用户只需上传商品图片,项目便会利★ 294ai-media-generatorai-media-generator 是一个面向 Claude Code 的 Skill 工具包,旨在让非专业用户也能像资深导演一样生成高质量 AI 图像、视频★ 251whatsapp-ai-bot这是一个开源的 WhatsApp AI 聊天机器人,基于 TypeScript 构建,集成了 Deepseek、GPT、DALL-E、Gemini、Stabil★ 248FreeFuseFreeFuse 是一个用于多主体 LoRA 融合的图像生成工具,解决在测试时(推理阶段)将多个 LoRA 模型动态组合到单个图像生成中的问题。它基于自适应 t★ 243HRDiTHRDiT 是 ECCV 2026 论文的官方实现,解决的是扩散 Transformer(DiT)模型在高分辨率图像生成时质量骤降的问题。现有 DiT(如 FL★ 233vox-ai-motion-graphics-generator这是一个为编程代理(如 Claude Code、Codex)设计的智能体技能,能将任意主题自动转化为 Vox 风格的纸拼贴解释视频。它解决了从脚本到成片全流程自★ 225ComfyUI-fal-APIComfyUI-fal-API 是一个将 fal.ai 平台 1400+ 生成式 AI 模型接入 ComfyUI 的官方自定义节点插件。它解决了 ComfyUI★ 220MooshieUIMooshieUI 是一个面向 ComfyUI 的桌面前端界面,专为初学者设计。它解决了 ComfyUI 原生节点式界面复杂难懂的问题,将底层工作流封装成直观的★ 203ImageCriticImageCritic 是 CVPR 2026 的官方实现,专注于图像生成中的一致性与定制化问题。它基于扩散模型(如 Flux)构建,提供一种批评或评估机制,用★ 170Comfyui-FlowChainComfyui-FlowChain 是一个将 ComfyUI 工作流封装为可复用节点,并支持链式调用的开源工具。它解决的是 ComfyUI 中复杂工作流难以模块★ 170Simple_Prompt_GeneratorSimple_Prompt_Generator 是一个面向 AI 图像生成模型的提示词生成工具,旨在帮助用户快速创建高质量、结构化的文本提示词,适用于 Midj★ 166comfyui-clientcomfyui-client 是一个面向 ComfyUI 的 TypeScript 客户端库,封装了所有 HTTP 和 WebSocket API,支持在 No★ 151awesome-flux-3-api-prompts这是一个面向 Black Forest Labs FLUX 3 模型的 API 使用指南与提示词合集。FLUX 3 是统一的多模态生成模型,支持文生视频、图生视★ 146comfyui-meshcomfyui-mesh 是一个针对 ComfyUI 的分布式推理扩展,旨在解决单 GPU 显存不足导致无法运行大型扩散模型(如 FLUX.2 和 LTX 2.★ 125stable-diffusion-cpp-pythonstable-diffusion-cpp-python 是 stable-diffusion.cpp 的 Python 绑定库,让开发者能在 Python 环境★ 124skills这是 Black Forest Labs 官方发布的智能体技能(Agent Skills)集合,面向 FLUX 系列图像与视频生成模型。它把 FLUX 的提示词★ 122cf-flux-remixcf-flux-remix 是一个基于 Cloudflare Workers 和 Workers AI 的免费文本生成图像项目,使用 FLUX.1 模型。它解决★ 119DJZ-WorkflowsDJZ-Workflows 是一个专注于 ComfyUI 工作流的开源集合,提供了 1000 多个用于 AI 图像和视频生成的工作流模板,覆盖 Flux、SDX★ 118