keda-gpu-scaler

无需 Prometheus,让 K8s 上的 GPU 工作负载按真实使用量自动伸缩。

keda-gpu-scaler 是一个基于 KEDA 外部 gRPC 扩展器的 GPU 自动扩缩容组件。它通过 DaemonSet 方式在每个节点上运行,直接利用 NVML 库采集 GPU 利用率、显存占用等原生指标,无需部署 Prometheus 等额外监控系统。该工具解决了 Kubernetes 中 GPU 工作负载(如模型推理服务)在流量波动时无法按 GPU 实际使用量弹性伸缩的问题,弥补了 KEDA 内置 scaler 对 GPU 指标支持的缺失。核心能力包括:实时采集 GPU 指标、通过 gRPC 协议与 KEDA 集成、根据自定义阈值触发扩缩容决策,从而帮助用户降低 GPU 资源成本,提升资源利用率。项目处于早期阶段,但设计简洁,部署轻量,适合已有 KEDA 且希望快速实现 GPU 弹性伸缩的团队。

开源 free 基础设施
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 130
维护状态 活跃
是否开源 是
定价模式 free

项目数据

分类基础设施
开发团队pmady
所属国家
官网地址
定价模式free
价格说明开源项目,Apache-2.0 许可证,可免费使用和自行部署。
访问状态
是否开源是
开源协议Apache-2.0
主要语言Go
技术栈/模型ai-infrastructure,autoscaling,daemonset,gpu,gpu-autoscaling,gpu-metrics,gpu-monitoring,grpc,inference,keda,keda-external-scaler,keda-scalers,kubernetes,mlops,nvidia,nvml,prometheus,scale-to-zero,triton,vllm
GitHub 星标★ 130
30天Star增速
HF 下载量
上线时间2026-03-12 00:00:00
最近更新2026-09-21 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数8

使用教程

核心亮点

  • 直接通过 NVML 采集 GPU 指标,省去 Prometheus 部署与维护成本
  • 以 DaemonSet 方式部署,每个节点自动采集,架构简单清晰
  • 与 KEDA 原生集成,利用成熟的事件驱动扩缩容机制

不足之处

  • 项目早期,文档和社区支持尚待完善
  • 仅支持 NVML 指标,对 AMD/其他 GPU 厂商兼容性未知

适用场景

  • 模型推理服务(如 LLM 推理)的 GPU 弹性伸缩
  • 多租户 GPU 资源共享场景下的按需扩容
  • 批量训练任务中 GPU 利用率波动的自动调整

替代项目

KEDA Prometheus Scaler、Datadog Cluster Agent Autoscaling、AWS Karpenter GPU 扩缩容

项目介绍

keda-gpu-scaler 是基础设施领域的开源项目,由 pmady 开发,是 2026 年新上线的项目。

它收录于基础设施分类,该分类目前共有 1,130 个项目,GitHub 星标数为 130。

项目目前处于活跃维护状态,最近一次代码更新于 2026-09-21。Apache-2.0 许可证,可免费使用和自行部署。

它主要面向的使用场景是:模型推理服务(如LLM推理)的GPU弹性伸缩。同类可对比的替代方案包括 KEDA Prometheus Scaler、Datadog Cluster Agent Autoscaling、AWS Karpenter GPU 扩缩容。

上一篇:qzcli_tool

下一篇:litellm

同类项目推荐

freebuff-proxy 开源

聚合多账号,一键接入 OpenAI 兼容 API,轻松管理会话。

Multi-account OpenAI-compatible gateway for coding models. Pooled keys, session life···

★ 213 2026-08-20
microduck 开源

用 Rust 造一只会走路的桌面小鸭,快速上手双足机器人。

A Tiny biped duck robot

★ 8684 2026-09-10
soperator 开源

用 Kubernetes 原生方式运行 Slurm,简化 HPC 集群管理。

Run Slurm in Kubernetes

★ 439 2026-08-10
ollama 开源

一条命令本地跑起大模型,免费、私密、不卡顿

Get up and running with Kimi, GLM, MiniMax, DeepSeek, gpt-oss, Qwen, Gemma and other···

★ 181484 2026-08-09