lmring 是评测安全领域的开源项目,由 llm-ring 开发,2025 年首次发布。
它收录于评测安全分类,该分类目前共有 458 个项目,GitHub 星标数为 221。
项目目前处于活跃维护状态,最近一次代码更新于 2026-09-18。从国内网络环境看,可直接访问。
它主要面向的使用场景是:团队内部评估多个LLM的对话质量。同类可对比的替代方案包括 LMSYS Chatbot Arena、OpenRouter Arena、Chatbot Arena UI。

自建 LLM 竞技场,让真实用户投票选出最强模型
lmring 是一个开源的、可自托管的 LLM 竞技场(Arena)平台,旨在解决大模型评测中缺乏真实用户反馈和直观对比的问题。它允许用户同时与多个模型对话,并基于真实对话进行投票和排名,从而生成动态的模型排行榜。项目采用 TypeScript 和 Next.js 构建,前端使用 React,后端依赖 Supabase 提供数据存储和认证服务。核心能力包括:多模型并行对话、匿名或用户投票机制、实时排行榜生成、以及基于 SweBench 等基准的集成。它支持 OpenAI、Claude、Gemini 等主流模型 API,并可通过环境变量灵活配置。作为早期项目(220 星),它提供了一个轻量级、可定制的替代方案,适合社区或团队内部快速搭建模型评测平台。
LMSYS Chatbot Arena、OpenRouter Arena、Chatbot Arena UI
lmring 是评测安全领域的开源项目,由 llm-ring 开发,2025 年首次发布。
它收录于评测安全分类,该分类目前共有 458 个项目,GitHub 星标数为 221。
项目目前处于活跃维护状态,最近一次代码更新于 2026-09-18。从国内网络环境看,可直接访问。
它主要面向的使用场景是:团队内部评估多个LLM的对话质量。同类可对比的替代方案包括 LMSYS Chatbot Arena、OpenRouter Arena、Chatbot Arena UI。
上一篇:rag-arena
下一篇:PersonaMem
akto
开源
给 AI 应用做安全体检,防提示注入和数据泄露
Akto is the fastest growing AI Security platform for your teams to secure AI agents,···
XSafeClaw
开源
给 AI 智能体装上安全盾,自动红队测试找漏洞
Introducing XSafeClaw: The Open-Source Agent Safety Platform from Fudan University
deepteam
开源
自动模拟越狱攻击,提前测出 LLM 安全漏洞
DeepTeam is a framework to red team LLMs and AI agents.
Tracely-ai
开源
把生产事故变成回归测试,合并前自动拦截 AI 故障
Trace-native CI/CD for AI agents — production failures become regression tests that···