ai-llm-comparison 是评测安全领域的开源项目,由 Ahmet-Dedeler 开发,2024 年首次发布。
它收录于评测安全分类,该分类目前共有 458 个项目,GitHub 星标数为 424。
项目目前处于活跃维护状态,最近一次代码更新于 2026-09-21。从国内网络环境看,当前已无法正常访问。
它主要面向的使用场景是:AI模型选型评估。同类可对比的替代方案包括 OpenRouter、Chatbot Arena、LiteLLM。

并排对比所有AI模型,快速选出最适合你的那个
这是一个用于对比各类AI模型的网站,旨在帮助用户直观了解不同大语言模型的能力差异。它解决了AI模型选择困难的问题,通过统一界面展示多个模型的响应结果,让用户能快速比较输出质量、速度和风格。项目基于Next.js 14构建,使用TypeScript开发,集成了LiteLLM作为模型调用网关,支持接入ChatGPT、Claude、Gemini等主流模型,并利用Supabase提供后端数据存储和实时功能。核心能力包括模型响应并排展示、参数调节、历史记录保存,以及通过GitHub协作和v0生成界面。目前处于早期阶段,星标423,适合对模型评测感兴趣的开发者使用。
OpenRouter、Chatbot Arena、LiteLLM
ai-llm-comparison 是评测安全领域的开源项目,由 Ahmet-Dedeler 开发,2024 年首次发布。
它收录于评测安全分类,该分类目前共有 458 个项目,GitHub 星标数为 424。
项目目前处于活跃维护状态,最近一次代码更新于 2026-09-21。从国内网络环境看,当前已无法正常访问。
它主要面向的使用场景是:AI模型选型评估。同类可对比的替代方案包括 OpenRouter、Chatbot Arena、LiteLLM。
上一篇:dialog-eval
下一篇:VLMEvalKit
akto
开源
给 AI 应用做安全体检,防提示注入和数据泄露
Akto is the fastest growing AI Security platform for your teams to secure AI agents,···
XSafeClaw
开源
给 AI 智能体装上安全盾,自动红队测试找漏洞
Introducing XSafeClaw: The Open-Source Agent Safety Platform from Fudan University
deepteam
开源
自动模拟越狱攻击,提前测出 LLM 安全漏洞
DeepTeam is a framework to red team LLMs and AI agents.
Tracely-ai
开源
把生产事故变成回归测试,合并前自动拦截 AI 故障
Trace-native CI/CD for AI agents — production failures become regression tests that···