RouterArena 是评测安全领域的开源项目,由 RouteWorks 开发,2025 年首次发布。
它收录于评测安全分类,该分类目前共有 498 个项目,GitHub 星标数为 144。
项目保持着较活跃的维护节奏,最近一次代码更新于 2026-09-29。开源免费框架,无付费服务。
它主要面向的使用场景是:研究团队对比不同LLM路由算法的效果与成本。同类可对比的替代方案包括 RouteLLM、LiteLLM。

统一基准评测 LLM 路由器,跑分上榜选型不踩坑
RouterArena 是一个面向 LLM 路由器的开源评测框架,解决当前路由方案各自为战、缺乏统一比较标准的问题。它提供标准化数据集、统一评测指标、自动化评测流程以及实时排行榜,让开发者能在同一基准下对比不同路由器的效果。核心能力包括:集成多种公开数据集与查询类型,定义准确率、成本、延迟等指标,自动跑通路由调用与结果统计,并把结果同步到在线榜单。对于研究多模型调度、成本优化、多智能体协作的团队,它把零散的评测脚本沉淀为可复现的公共基准,降低横向对比门槛。项目用 Python 实现,适合作为路由算法选型、论文实验和产品落地的参考依据。
本站每日记录该项目 GitHub 星标变化,观测越久曲线越完整
—
RouteLLM、LiteLLM
RouterArena 是评测安全领域的开源项目,由 RouteWorks 开发,2025 年首次发布。
它收录于评测安全分类,该分类目前共有 498 个项目,GitHub 星标数为 144。
项目保持着较活跃的维护节奏,最近一次代码更新于 2026-09-29。开源免费框架,无付费服务。
它主要面向的使用场景是:研究团队对比不同LLM路由算法的效果与成本。同类可对比的替代方案包括 RouteLLM、LiteLLM。
akto
开源
给 AI 应用做安全体检,防提示注入和数据泄露
Akto is the fastest growing AI Security platform for your teams to secure AI agents,···
XSafeClaw
开源
给 AI 智能体装上安全盾,自动红队测试找漏洞
Introducing XSafeClaw: The Open-Source Agent Safety Platform from Fudan University
deepteam
开源
自动模拟越狱攻击,提前测出 LLM 安全漏洞
DeepTeam is a framework to red team LLMs and AI agents.
fast-llm-security-guardrails
开源
给 AI Agent 加一道快速安全闸门,防提示注入和隐私泄露
The fastest Trust Layer for AI Agents