llm-on-openshift

在 OpenShift 上快速跑通 LLM 部署与推理

llm-on-openshift 是 Red Hat 官方维护的开源资源集合,面向在 OpenShift 上运行大语言模型(LLM)的工程师与数据科学家。它解决的核心问题是:把 LLM 从本地实验搬到企业级 Kubernetes 平台时,缺少可复用的部署模板、示例和最佳实践。项目提供大量 Jupyter Notebook、YAML 清单、Helm 风格配方和演示,覆盖模型服务(如 vLLM、TGI、Caikit)、推理优化、RAG 检索增强、微调、向量数据库集成、监控与自动扩缩容等环节。所有内容围绕 OpenShift AI 或 Open Data Hub 技术栈设计,能直接跑在集群里,帮助团队快速搭建从模型加载、API 暴露到应用集成的完整链路,降低平台落地门槛。

开源 free 基础设施
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 149
维护状态 较活跃
是否开源
定价模式 free

项目数据

分类基础设施
开发团队rh-aiservices-bu
所属国家
官网地址
定价模式free
价格说明开源免费,需自行部署
访问状态
是否开源
开源协议Apache-2.0
主要语言Python
技术栈/模型
GitHub 星标★ 149
30天Star增速
HF 下载量
上线时间2023-09-26 00:00:00
最近更新2026-08-31 00:00:00
维护状态较活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-16
浏览次数0

使用教程

核心亮点

  • 提供大量可直接运行的 Notebook 和 YAML 示例,覆盖 vLLM、TGI、Caikit 等主流推理后端
  • 与 OpenShift AI/Open Data Hub 深度集成,包含模型服务、RAG、微调、监控等端到端配方
  • 由 Red Hat 官方维护,内容随平台版本更新,适合企业内做 PoC 和参考架构

不足之处

  • 项目定位是资源集合而非独立产品,缺少统一 CLI 或一键部署工具
  • 部分示例依赖较新的 OpenShift AI 版本和特定 GPU 环境,通用性受限

适用场景

  • 企业内基于 OpenShift 搭建 LLM 推理服务并对外提供 API
  • 数据科学家用 Jupyter Notebook 在集群上做模型微调与 RAG 实验
  • 平台团队参考官方配方设计 GPU 资源调度、自动扩缩容和监控方案

替代项目

KServe、vLLM、Ray Serve

项目介绍

llm-on-openshift 是一个基础设施领域的开源项目,官方简介:Resources, demos, recipes,... to work with LLMs on OpenShift with OpenShift AI or Open Data Hub.。项目使用 Python 开发,在 GitHub 上获得 149 星标。

上一篇:llm-d-inference-sim

下一篇:eLLM

同类项目推荐

freebuff-proxy 开源

聚合多账号,一键接入 OpenAI 兼容 API,轻松管理会话。

OpenAI-compatible gateway for FreeBuff coding models. Token pool, session lifecycle,···

★ 202 2026-08-20
microduck 开源

用 Rust 造一只会走路的桌面小鸭,快速上手双足机器人。

A Tiny biped duck robot

★ 8433 2026-09-10
soperator 开源

用 Kubernetes 原生方式运行 Slurm,简化 HPC 集群管理。

Run Slurm in Kubernetes

★ 435 2026-08-10
ollama 开源

一条命令本地跑起大模型,免费、私密、不卡顿

Get up and running with Kimi, GLM, MiniMax, DeepSeek, gpt-oss, Qwen, Gemma and other···

★ 181124 2026-08-09