semantic-router

按语义智能分发请求,让每个模型干最擅长的活

semantic-router 是一个用 Go 编写的可编程混合模型路由器,专为异构 LLM 推理场景设计。它解决的核心问题是:当企业或开发者需要同时调用多个不同的大语言模型(如 GPT、Claude、Llama 等)时,如何根据请求的语义特征智能地选择最合适的模型,从而优化成本、延迟和响应质量。该项目的核心能力包括:基于语义相似度的路由决策、可编程的路由规则配置、支持动态调整模型权重、以及与主流 LLM API 的无缝集成。它通过将请求分发到最擅长的模型,避免了对单一模型的依赖,提升了整体推理效率。项目处于成长阶段,已有超过 5000 星标,社区活跃,适合需要多模型协同工作的生产环境。

开源 free 开源模型
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 5898
维护状态 活跃
是否开源 是
定价模式 free

项目数据

分类开源模型
开发团队vllm-project
所属国家
官网地址https://vllm-sr.ai
定价模式free
价格说明开源项目,Apache-2.0许可证,可免费使用和部署。
访问状态
是否开源是
开源协议Apache-2.0
主要语言Go
技术栈/模型ai-gateway,guardrails,inference,kubernetes,llm,llmrouter,mixture-of-models,pytorch,semantic-router,transformer,vllm
GitHub 星标★ 5898
30天Star增速
HF 下载量
上线时间2025-08-26 00:00:00
最近更新2026-09-22 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数6

使用教程

难度:入门 约 10 分钟 部署方式:命令行工具 4 步

环境要求

  • 类 Unix 环境(Linux / macOS),可运行 bash 与 curl
  • Windows 用户建议使用 WSL 等 bash 环境
  • 已具备访问外网以下载安装脚本的能力
  • Python 环境(pip / uv 安装方式见官方安装指南,README 未给出具体命令)

安装与启动步骤

  1. 1确认系统环境

    安装脚本为 bash 脚本,需在 Linux、macOS 或 WSL 中执行;确认已安装 curl 且网络可访问 vllm-sr.ai。

  2. 2执行安装脚本

    从官网下载并运行安装脚本,--channel stable 表示安装稳定版通道;脚本会自行完成后续安装动作。

    curl -fsSL https://vllm-sr.ai/install.sh | bash -s -- --channel stable
  3. 3查阅安装指南

    README 指向官方 Installation Guide,pip、uv 或智能体驱动的安装方式均在该文档中说明,按需选择。

  4. 4体验路由效果

    打开官方 Playground 在线体验路由器效果,了解模型选择与组合方式,无需本地部署即可试用。

如何确认成功

README 未给出本地启动或健康检查命令,安装完成后请按官方 Installation Guide 确认,并可访问 Playground 验证路由功能。

常见问题

Q:可以用 pip 或 uv 安装吗?

A:README 说明可参考官方 Installation Guide(https://vllm-sr.ai/docs/installation/),但未在 README 中给出具体 pip/uv 命令。

Q:安装后如何启动服务?

A:README 未提供启动命令、端口或配置文件说明,请查阅 vllm-sr.ai 官方文档获取启动方式。

Q:可以先用在线环境试玩吗?

A:可以,README 提供 Playground 地址 https://app.vllm-sr.ai/playground,可直接在线体验。

Q:Windows 上能安装吗?

A:安装命令为 bash 脚本,README 未说明 Windows 原生支持,建议在 WSL 中执行该命令。

注意事项

  • 安装脚本通过 curl 管道直接交给 bash 执行,请确认来源为官网 vllm-sr.ai 后再运行。
  • README 仅提供安装命令,未给出启动、端口、配置文件等细节,生产使用前请先阅读官方文档。
  • 该项目是 Go 编写的可编程混合模型路由层,用于在异构 LLM 基础设施间按语义选择模型路径。
  • 若需自定义路由策略或权重,请以官网文档和 Publications 中的说明为准。

核心亮点

  • 基于语义路由,而非简单轮询或固定规则,能显著提升响应质量
  • Go 语言实现,性能高,适合高并发推理场景
  • 可编程配置,支持自定义路由策略和模型权重

不足之处

  • 文档/社区待观察
  • 生态较新,与主流框架的集成案例可能不够丰富

适用场景

  • 多模型 A/B 测试,动态选择最优模型
  • 成本敏感场景,将简单请求路由到便宜模型,复杂请求路由到高级模型
  • 构建高可用 LLM 服务,实现模型故障转移和负载均衡

替代项目

LiteLLM Router、OpenRouter、LangChain Router

项目介绍

semantic-router 是基础设施领域的开源项目,由 vllm-project 开发,2025 年首次发布。

在全站 13,090 个收录项目中,它的 GitHub 星标数(5,898)位列前 8%,在基础设施分类的 1,132 个项目里位列前 12%。

近 41 天,它的 GitHub 星标从 5,144 增加到 5,898,净增 754。

项目目前处于活跃维护状态,最近一次代码更新于 2026-09-22。Apache-2.0许可证,可免费使用和部署。

它主要面向的使用场景是:多模型A/B测试,动态选择最优模型。同类可对比的替代方案包括 LiteLLM Router、OpenRouter、LangChain Router。

上一篇:lemonade

下一篇:text-embeddings-inference

同类项目推荐

freebuff-proxy 开源

聚合多账号,一键接入 OpenAI 兼容 API,轻松管理会话。

Multi-account OpenAI-compatible gateway for coding models. Pooled keys, session life···

★ 213 2026-08-20
microduck 开源

用 Rust 造一只会走路的桌面小鸭,快速上手双足机器人。

A Tiny biped duck robot

★ 8684 2026-09-10
soperator 开源

用 Kubernetes 原生方式运行 Slurm,简化 HPC 集群管理。

Run Slurm in Kubernetes

★ 439 2026-08-10
ollama 开源

一条命令本地跑起大模型,免费、私密、不卡顿

Get up and running with Kimi, GLM, MiniMax, DeepSeek, gpt-oss, Qwen, Gemma and other···

★ 181484 2026-08-09