kubernetes
本站收录 155 个带「kubernetes」标签的 AI 开源项目(按 GitHub 星标从高到低,此处展示前 50 个)
minioMinIO 是一个高性能、S3 兼容的对象存储系统,采用 Go 语言开发,以 GNU AGPLv3 协议开源。它旨在为云原生环境提供轻量级、可扩展的存储解决方案★ 61,347
kongKong 是一个云原生的 API 网关和 AI 网关,基于 Nginx 和 OpenResty 构建,使用 Lua 编写。它解决了微服务架构中 API 管理、流★ 44,219
ToolJetToolJet 是一个开源的低代码内部工具构建平台,旨在帮助团队快速搭建内部工具、仪表盘、业务应用和工作流。它解决了企业开发内部工具时重复造轮子、开发周期长、维★ 41,014
Portainer 容器管理面板Docker 可视化管理面板:容器/镜像/网络/日志/存储,Web 界面直管本机 Docker。社区版免费,中文界面。★ 38,606
serve基于云原生技术栈构建多模态 AI 应用的框架,让开发者可以像搭积木一样编排微服务化的 AI 流水线。它天然支持文本、图像、音视频等多种模态的模型编排与扩展,配合★ 21,864
apisixApache APISIX 是一个云原生、高性能、可扩展的 API 网关和 AI 网关。它基于 Nginx 和 etcd 构建,采用 Lua 语言编写,解决了微★ 17,173
kubesphereKubeSphere 是一款以应用容器为核心的云原生分布式操作系统,旨在解决 Kubernetes 原生集群在易用性、可观测性、多集群管理及云边协同等方面的复杂★ 17,061
argo-workflows运行在 Kubernetes 之上的容器原生工作流引擎,以 CRD 方式定义 DAG 任务编排,天然适配云原生环境。它支持并行任务、参数化模板、工件传递与定时触★ 17,011
docker-androiddocker-android 是一个把 Android 模拟器完整封装进 Docker 容器的开源方案,解决在 CI/CD、云端或本地无头服务器上运行 Andr★ 15,884
OpenSandboxOpenSandbox 是一个专为 AI 智能体设计的沙箱运行时,提供安全、快速且可扩展的执行环境。它解决了 AI 智能体在运行代码、操作文件或访问外部资源时面★ 15,587
metaflowNetflix 开源的 AI/ML 系统构建与管理框架,帮助开发者轻松编写、运行和部署机器学习流水线。它提供了简洁的 Python API,支持本地开发与云端规★ 10,283
docker-seleniumdocker-selenium 提供了一套开箱即用的容器镜像与编排方案,让 Selenium Grid 能基于 Docker、Kubernetes 或 Helm★ 8,656
flyteFlyte 是一个开源的云原生编排平台,专注于数据、机器学习和 AI 工作流的自动化。它解决的是在复杂生产环境中,数据管道、模型训练和推理任务难以统一调度和可靠★ 7,602
superplanesuperplane 是一个开源的智能体工程控制平面,旨在为 AI 代理驱动的工程流程提供统一的管理和自动化底座。它解决的是在复杂软件交付中,多个 AI 代理、★ 7,546
rainbondRainbond 是一个开源的 AI 应用运行时平台,核心能力 100% 开源。它解决的是 AI 生成项目、大模型服务、开源 AI 软件和传统业务应用在 Kub★ 6,268
kserveKServe 是一个基于 Kubernetes 的标准化的分布式生成式 AI 和预测式 AI 推理平台,旨在为可扩展、多框架的模型部署提供统一解决方案。它解决了★ 6,046
semantic-routersemantic-router 是一个用 Go 编写的可编程混合模型路由器,专为异构 LLM 推理场景设计。它解决的核心问题是:当企业或开发者需要同时调用多个不★ 5,980
mirrord让本地或 AI 代理环境中的任何进程,都像运行在 Kubernetes 集群的 Pod 中一样,拥有真实的环境变量、DNS、网络与流量。无需重新部署即可在本机调★ 5,344
OlaresOlares 是一个开源的个人云操作系统,专为常驻智能体(Always-On Agents)设计。它解决了个人在本地或边缘环境部署、运行和管理 AI 智能体时面★ 5,294
agentgatewayagentgateway 是一个用 Rust 编写的新一代 AI Agent 代理网关,专门为 AI Agent 和 MCP 服务器设计。它解决了 Agent ★ 5,090
cube-studiocube-studio 是一个开源的云原生一站式 AI 平台,覆盖机器学习、深度学习和 LLMOps 全链路。它解决了 AI 开发中环境搭建复杂、资源利用率低、★ 5,079
seldon-coreSeldon Core 是一个用于打包、部署、监控和管理生产环境中机器学习模型的开源 MLOps 框架。它解决了将训练好的模型(如 TensorFlow、PyT★ 4,782
llm-dllm-d 是一个专注于在 Kubernetes 上实现现代加速器(如 GPU)上最先进推理性能的开源项目。它解决了在云原生环境中部署大型语言模型时面临的性能瓶★ 4,679
mcp-context-forgemcp-context-forge 是一个面向 AI Agent 与工具调用的统一网关、注册中心和代理服务。它位于 MCP、A2A 以及 REST/gRPC A★ 4,541
oracle-ai-developer-hubOracle AI Developer Hub 是 Oracle 官方推出的 AI 开发者技术资源库,旨在帮助开发者利用 Oracle AI 数据库(如 Aut★ 4,398
serveServe 是一个用于在生产环境中部署、优化和扩展 PyTorch 模型的开源基础设施项目。它解决了将训练好的 PyTorch 模型高效、稳定地服务化的问题,提★ 4,344
deepflowDeepFlow 是一个基于 eBPF 的分布式追踪与性能剖析平台,旨在解决云原生环境下应用可观测性不足的问题。它利用 eBPF 技术自动采集应用、网络和系统层★ 4,283
pipelinespipelines 是 Kubeflow 项目下的机器学习流水线组件,用于在 Kubernetes 上构建、部署和管理端到端的 ML 工作流。它解决了机器学习实★ 4,230
octeliumoctelium 是一个下一代开源自托管的统一零信任安全访问平台,用 Go 语言编写。它集多种功能于一身:既可作为远程访问 VPN,也可作为 ZTNA(零信任网★ 4,080
polyaxonPolyaxon 是一个开源的 AI 基础设施平台,定位为 AI 编排与控制平面。它解决的是机器学习生命周期中实验管理、模型训练、超参数调优、模型部署等环节缺乏★ 3,737
radarRadar 是一个开源的 Kubernetes 可视化界面,内置 MCP(Model Context Protocol)服务器,专为 AI 智能体设计。它解决了★ 3,548
holmesgptHolmesGPT 是一个面向 SRE(站点可靠性工程)场景的开源 AI 助手,已加入 CNCF Sandbox。它通过自然语言交互,帮助运维和开发人员快速诊断★ 3,480
determinedDetermined 是一个开源机器学习平台,旨在简化分布式训练、超参数调优、实验追踪和资源管理。它支持 PyTorch 和 TensorFlow,提供统一的 ★ 3,241
kitekite 是一个轻量级、现代化的 Kubernetes 仪表盘,旨在将多集群与资源管理、企业级用户治理(OAuth、RBAC、审计日志)以及 AI 智能体统一到★ 3,150
argo-eventsargo-events 是一个基于 Kubernetes 的事件驱动自动化框架,用于构建事件驱动的工作流和流水线。它解决了云原生环境中事件源分散、事件处理复杂的★ 2,695
paipai 是一个面向 AI 场景的资源调度与集群管理平台,主要解决 GPU 等异构计算资源在深度学习训练和推理任务中的分配效率问题。它支持多种 AI 框架(如 C★ 2,694
AudioMuse-AIAudioMuse-AI 是一个开源的智能音乐分析引擎,专注于解决音乐库中“有歌却难找”的痛点。它通过声学分析技术,不依赖任何元数据或外部服务,直接对音频文件进★ 2,672
agentfieldagentfield 是一个用 Go 语言构建的 AI 代理编排平台,旨在将 AI 代理像 API 和微服务一样进行构建、运行和扩展。它解决了 AI 代理从原型★ 2,592
cube-studiocube-studio 是一个基于云原生的开源 AI 平台,旨在统一管理机器学习、深度学习及大模型的完整生命周期。它解决企业在算法开发、训练、部署和运维中的碎片★ 2,529
awesome-argoawesome-argo 是一个精心整理的 Argo 生态资源清单,Argo 是 CNCF 毕业项目,包含 Argo Workflows、Argo CD、Arg★ 2,493
fullingFulling 是一个 AI 驱动的全栈工程师智能体,基于 Next.js、Claude、shadcn/ui 和 PostgreSQL 构建,并以 Kubern★ 2,445
botkubeBotkube 是一个开源的 Kubernetes 运维聊天机器人,它将 Kubernetes 集群事件实时推送到 Slack、Microsoft Teams、★ 2,313
dstackdstack 是一个厂商中立的编排平台,专为 AI 训练、推理和智能体工作负载设计。它解决了 AI 团队在混合基础设施(云、Kubernetes、裸金属)上运行★ 2,264
trainertrainer 是一个基于 Kubernetes 的分布式 AI 模型训练与 LLM 微调平台,由开源社区维护。它解决了在 Kubernetes 上运行大规模训★ 2,234
ai-gatewayai-gateway 是一个基于 Envoy Gateway 构建的统一访问管理网关,专门用于管理和路由对各类生成式 AI 服务的请求。它解决了企业在使用多个 ★ 2,159
kubewallkubewall 是一个用 Go 和 TypeScript 构建的单二进制 Kubernetes 仪表盘,专注于多集群管理和 AI 集成。它解决了传统 Kube★ 1,938
valqorevalqore 是一个面向 AI 驱动云和 Kubernetes 运维的安全护栏框架。它解决的是当 AI 或自动化脚本直接操作云基础设施时,可能因误操作、权限过★ 1,910
ClawManagerClawManager 是一个 Kubernetes 原生的 AI Agent 实例管理控制平面,用 Go 编写。它要解决的问题是:当团队在 K8s 上跑多个 ★ 1,895
ai-infra-engineer-learning面向生产级 ML 基础设施的系统学习路线,专为有 2~4 年经验的工程师设计。课程涵盖模型训练、推理服务、算力调度、可观测性等基础设施核心主题,帮助工程师补齐从★ 1,746
katibKatib 是一个基于 Kubernetes 的自动化机器学习(AutoML)平台,旨在解决在云原生环境中进行超参数调优、神经网络架构搜索(NAS)和早停(Ea★ 1,704