wan
本站收录 19 个带「wan」标签的 AI 开源项目
sglangSGLang 是一个高性能的大语言模型和多模态模型服务框架,旨在解决 LLM 推理服务中吞吐量低、延迟高、显存利用率不足等问题。它通过 RadixAttenti★ 36,594
stable-diffusion.cpp纯 C/C++ 实现的扩散模型推理库,无需 Python 环境即可运行 SD、Flux、Wan、Qwen Image、Z-Image 等主流模型,性能卓越、部署★ 7,469
comfyui-mcpComfyUI-MCP 是一个本地优先、面向智能体的 ComfyUI 控制平面,包含 MCP 服务器和侧边栏智能体。它解决了 ComfyUI 操作门槛高、工作流★ 774
LightCompressLightCompress 是一个面向大模型压缩的开源工具包,由 EMNLP 2024 和 AAAI 2026 论文支撑,支持对 LLM(大语言模型)、VLM(★ 749
higgsfield-ai-prompt-skill这是一个为 Claude Code 设计的 AI 技能包,专注于生成电影级 Higgsfield AI 视频提示词。它包含 32 个子技能,覆盖 Seedanc★ 646
MaestroMaestro 是一个 100% 本地运行的一站式 AI 视频、图像和音乐创作工作室,基于 WanGP 管线构建,通过 Pinokio 一键安装。它解决的是本地★ 640
Awesome-DiT-InferenceAwesome-DiT-Inference 是一个精选的扩散模型推理加速论文与代码资源列表,专注于 DiT(Diffusion Transformer)架构。它★ 592
LoongForgeLoongForge 是一个面向大模型训练的统一高性能框架,支持在 NVIDIA GPU 和昆仑芯 XPU 上训练 LLM、VLM、扩散模型及具身智能模型。它解★ 582
lanshu-awesome-ai-video-kit这是一个从企业级AI视频项目实战中提炼出的工具包,汇集了411个提示词、15个主流视频生成模型(如可灵、即梦、混元、CogVideoX等)、7个Claude S★ 407
sdk这是一个面向视频生成场景的TypeScript SDK,核心思路是用JSX语法来声明式地描述视频内容,然后通过统一API接入Kling、Flux、ElevenL★ 340
Echo-MemoryEcho-Memory 是一个用于视频世界模型研究的简单基线项目,核心思路是引入显式记忆机制来提升视频生成的时间连贯性与物理合理性。它解决的是当前视频生成模型在★ 253
awesome-ai-video-models这是一个关于AI视频生成模型的精选资源列表,旨在提供最完整、最新的模型对比信息。它系统性地整理了当前主流的AI视频生成模型,包括可灵、海螺、混元、Luma等,并★ 196
comfyUI-LongLookLongLook 是一个 ComfyUI 节点包,将 NeurIPS 2024 论文 FreeLong 的频谱混合技术引入 Wan 2.2 视频生成流程。它解决★ 166
comfyui-clientcomfyui-client 是一个面向 ComfyUI 的 TypeScript 客户端库,封装了所有 HTTP 和 WebSocket API,支持在 No★ 151
LiveWorldLiveWorld 是 ECCV 2026 论文的官方实现,旨在解决生成式视频世界模型中“视野外动态”的模拟问题。传统视频生成模型只能基于可见帧进行预测,而 L★ 144
LongLive-RAGLongLive-RAG 是一个面向长视频生成的通用检索增强框架,其官方实现基于 PyTorch。它解决的是现有视频生成模型难以生成长时间、多场景连贯视频的问题★ 114
MeanFlowNFTMeanFlowNFT 是一个基于 PyTorch 的图像生成开源项目,对应 arXiv 2026 论文,核心思想是将前向过程强化学习引入平均速度生成器。它针对★ 95
sd-forge-deforumsd-forge-deforum 是 Deforum 扩展的一个分支,专门为 Stable Diffusion WebUI Forge 优化,并引入了关键帧同步★ 67
data-forcing-distillationData-Forcing Distillation (DFD) 是一个用于少步视频生成的蒸馏方法,旨在解决现有蒸馏技术在少步生成时出现的多样性和保真度下降问题。★ 59