ai-gateway

一个网关管所有AI大模型,统一接入、限流、控成本

ai-gateway 是一个基于 Envoy Gateway 构建的统一访问管理网关,专门用于管理和路由对各类生成式 AI 服务的请求。它解决了企业在使用多个 AI 提供商(如 OpenAI、Anthropic、Google 等)时面临的 API 管理混乱、成本不可控、安全策略不统一等问题。核心能力包括:统一的 API 端点,屏蔽不同提供商的协议差异;细粒度的访问控制、速率限制和配额管理;请求级和令牌级的成本追踪与审计;支持多模型路由、故障转移和 A/B 测试;以及通过 Envoy 的高性能代理能力,实现低延迟和高吞吐。项目采用 Go 语言开发,与 Envoy Gateway 深度集成,适合需要大规模、生产级 AI 流量管理的平台团队。

开源 free 开源模型
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 2131
维护状态 活跃
是否开源 是
定价模式 free

项目数据

分类开源模型
开发团队theagentrouter
所属国家
定价模式free
价格说明开源项目,基于Envoy Gateway,可自行部署,完全免费。
访问状态
是否开源是
开源协议Apache-2.0
主要语言Go
技术栈/模型ai,ai-gateway,api-gateway,envoy,envoyproxy,inference,kubernetes,llm
GitHub 星标★ 2131
30天Star增速
HF 下载量
上线时间2024-10-21 00:00:00
最近更新2026-09-23 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数4

使用教程

难度:入门 约 10 分钟 部署方式:命令行工具 5 步

环境要求

  • 一个可用的 OpenAI API Key(形如 sk-xxxxxxxx)
  • 本地已安装 aigw CLI(README 只给出官方 CLI 指南链接,未给出具体安装命令)
  • 本地 1975 端口可用(aigw run 默认监听该端口)
  • 如在 Kubernetes 上部署,需额外安装 Envoy Gateway(参见 Getting Started 指南)

安装与启动步骤

  1. 1安装 aigw 命令行

    README 未给出安装命令,请按官方 CLI 指南完成安装,并确认终端中可直接执行 aigw。

  2. 2准备 OpenAI 密钥

    把 OpenAI 的 API Key 导出为环境变量,后续启动命令会读取它,勿把真实密钥提交到仓库。

    export OPENAI_API_KEY=sk-your-key
  3. 3一条命令启动网关

    README 的 Quick start 命令:以独立、OpenAI 兼容路由的形式在笔记本上运行,默认监听 1975 端口。

    OPENAI_API_KEY=sk-your-key aigw run
  4. 4接入 OpenAI 兼容客户端

    把任意 OpenAI 兼容客户端的 base URL 指向 http://localhost:1975/v1,即可通过统一端点访问后端模型。

  5. 5部署到 Kubernetes

    需要生产级部署时,按官方 Getting Started 指南在 Kubernetes 上配合 Envoy Gateway 部署。

关键配置

配置项必填说明示例
OPENAI_API_KEY是启动时注入的 OpenAI 密钥,用于网关访问上游模型服务sk-your-key

如何确认成功

客户端指向 http://localhost:1975/v1 能正常返回模型响应,且本地 1975 端口处于监听状态。

常见问题

Q:aigw 命令行工具怎么安装?

A:README 的 Quick start 只给出运行命令,安装方式请查看官方 CLI 指南(https://theagentrouter.ai/docs/cli/),其中还包含各家提供商的自动配置。

Q:支持哪些模型提供商?

A:它提供统一的 OpenAI 兼容 API,可对接托管提供商、自托管推理服务以及 MCP 服务器,屏蔽各提供商协议差异。

Q:原来的 Envoy AI Gateway 资源需要改名吗?

A:不需要。项目已更名为 Agent Router,但代码、维护者、发布节奏和 Apache 2.0 许可不变,CRD 与 API group aigateway.envoyproxy.io 均未改动。

注意事项

  • README 未给出 aigw 的安装命令,安装步骤必须以官方 CLI 指南为准,不要臆造包名或参数。
  • 默认本地服务地址与端口为 http://localhost:1975/v1,如与其他服务冲突需自行调整。
  • 生产环境建议采用两层网关模式:一层负责认证、顶层路由与全局限流,二层负责自托管模型集群的入口流量与推理端点选择。
  • 升级或迁移前请查阅官方 Release Notes,确认 CRD 与 API group 的兼容性。

核心亮点

  • 基于 Envoy Gateway,性能与稳定性有保障,适合生产环境
  • 提供统一 API 接入,屏蔽多家 AI 服务商差异,切换模型无需改代码
  • 内置成本追踪和配额管理,能精确到令牌级,帮助控制 AI 开销

不足之处

  • 文档/社区待观察
  • 与 Envoy Gateway 深度绑定,对非 Envoy 技术栈的团队有学习成本

适用场景

  • 企业内部多个 AI 模型统一接入与治理
  • SaaS 平台对外提供 AI 能力,需计费和限流
  • 多模型灾备与流量切换场景

替代项目

Kong AI Gateway、LiteLLM、Portkey AI Gateway

项目介绍

ai-gateway 是基础设施领域的开源项目,由 theagentrouter 开发,2024 年首次发布。

在全站 13,090 个收录项目中,它的 GitHub 星标数(2,131)位列前 30%,在基础设施分类中处于中上游。

近 42 天,它的 GitHub 星标从 1,922 增加到 2,131,净增 209。

项目目前处于活跃维护状态,最近一次代码更新于 2026-09-23。基于Envoy Gateway,可自行部署,完全免费。

它主要面向的使用场景是:企业内部多个AI模型统一接入与治理。同类可对比的替代方案包括 Kong AI Gateway、LiteLLM、Portkey AI Gateway。

上一篇:tokencost

下一篇:Ollamac

同类项目推荐

freebuff-proxy 开源

聚合多账号,一键接入 OpenAI 兼容 API,轻松管理会话。

Multi-account OpenAI-compatible gateway for coding models. Pooled keys, session life···

★ 213 2026-08-20
microduck 开源

用 Rust 造一只会走路的桌面小鸭,快速上手双足机器人。

A Tiny biped duck robot

★ 8684 2026-09-10
soperator 开源

用 Kubernetes 原生方式运行 Slurm,简化 HPC 集群管理。

Run Slurm in Kubernetes

★ 439 2026-08-10
ollama 开源

一条命令本地跑起大模型,免费、私密、不卡顿

Get up and running with Kimi, GLM, MiniMax, DeepSeek, gpt-oss, Qwen, Gemma and other···

★ 181484 2026-08-09