customization
本站收录 11 个带「customization」标签的 AI 开源项目
Awesome-Controllable-Diffusion这是一个聚焦扩散模型可控生成的精选资源列表,收录了ControlNet、DreamBooth、IP-Adapter等前沿方法的论文与代码。它系统梳理了从结构控制★ 504
Open-OmniVCusOmniVCus 是一个面向视频定制生成的开源项目,基于扩散模型(Diffusion Models)和 Transformer 架构,支持通过多模态控制条件(如★ 495
heige-codex-skin-studio这是一个为 OpenAI Codex 桌面版(基于 Electron 的 ChatGPT 客户端)提供一键换肤功能的工具。它通过 CDP(Chrome DevT★ 478
M.I.L.E.SM.I.L.E.S 是一个基于 GPT-4-Turbo 的桌面语音助手,旨在提供类似 JARVIS 的智能交互体验。它解决了传统语音助手功能单一、无法个性化定制★ 236
Video-Motion-CustomizationVideo-Motion-Customization(VMC)是一个基于扩散模型的视频运动定制工具,核心解决文本到视频生成中运动模式难以精确控制的问题。它通过引★ 200
vistorybenchViStoryBench 是一个面向 AI 故事可视化任务的基准测试集,由 CVPR 2026 论文提出。它解决的核心问题是:当前图像生成模型在生成连贯、风格一★ 173
custom-diffusion360CustomDiffusion360 是一个基于 Stable Diffusion 的文本生成图像定制化扩展项目,核心解决现有定制化模型(如 DreamBoot★ 172
ImageCriticImageCritic 是 CVPR 2026 的官方实现,专注于图像生成中的一致性与定制化问题。它基于扩散模型(如 Flux)构建,提供一种批评或评估机制,用★ 170
syncdSynCD 是一个用于文本到图像定制化(Text-to-Image Customization)的合成数据生成工具,源自 ICCV 2025 论文。它解决的是个★ 156
SpeakThatSpeakThat 是一款 Android 平台的开源通知朗读工具,旨在将手机上的各类通知通过文字转语音(TTS)实时播报出来,让用户在不看屏幕的情况下也能掌握★ 135
UniDiffusionUniDiffusion 是一个基于 diffusers 库的扩散模型训练工具箱,旨在统一多种主流个性化生成方法(如 Dreambooth、Textual In★ 83