synbad 是评测安全领域的开源项目,由 synthetic-lab 开发,2025 年首次发布。
它收录于评测安全分类,该分类目前共有 498 个项目,GitHub 星标数为 130。
项目目前处于活跃维护状态,最近一次代码更新于 2026-10-02。开源免费,无定价信息。
它主要面向的使用场景是:选型阶段对比多家开源模型托管平台的实际输出质量。同类可对比的替代方案包括 lm-evaluation-harness、promptfoo。

同一模型多家推理服务商,跑一轮评测看谁更靠谱
synbad 是一个用 TypeScript 编写的 LLM 评测工具,专门用来测试开源推理服务商(inference providers)的实际表现。它解决的核心问题是:同一批开源模型在不同托管平台上,输出质量、响应速度、稳定性可能差异很大,开发者很难判断该选哪家。synbad 通过内置的评测集和统一调用接口,把多个推理服务商放在同一标准下对比,帮助用户发现哪家服务在特定任务上更可靠。项目定位偏轻量,适合在选型阶段快速跑一轮基准测试,也适合持续监控已接入服务商的质量波动。核心能力包括:统一的 provider 适配层、可配置的评测任务、结果对比输出。作为早期项目,它更偏向实用工具而非完整评测平台,适合开发者按需扩展自己的测试用例。
本站每日记录该项目 GitHub 星标变化,观测越久曲线越完整
—
lm-evaluation-harness、promptfoo
synbad 是评测安全领域的开源项目,由 synthetic-lab 开发,2025 年首次发布。
它收录于评测安全分类,该分类目前共有 498 个项目,GitHub 星标数为 130。
项目目前处于活跃维护状态,最近一次代码更新于 2026-10-02。开源免费,无定价信息。
它主要面向的使用场景是:选型阶段对比多家开源模型托管平台的实际输出质量。同类可对比的替代方案包括 lm-evaluation-harness、promptfoo。
上一篇:augustus
下一篇:没有了!
akto
开源
给 AI 应用做安全体检,防提示注入和数据泄露
Akto is the fastest growing AI Security platform for your teams to secure AI agents,···
XSafeClaw
开源
给 AI 智能体装上安全盾,自动红队测试找漏洞
Introducing XSafeClaw: The Open-Source Agent Safety Platform from Fudan University
deepteam
开源
自动模拟越狱攻击,提前测出 LLM 安全漏洞
DeepTeam is a framework to red team LLMs and AI agents.
fast-llm-security-guardrails
开源
给 AI Agent 加一道快速安全闸门,防提示注入和隐私泄露
The fastest Trust Layer for AI Agents