chinese-llm-benchmark 是评测安全领域的开源项目,由 jeinlee1991 开发,2023 年首次发布。
在全站 13,014 个收录项目中,它的 GitHub 星标数(6,450)位列前 7%,在评测安全分类的 458 个项目里位列前 5%。
近 44 天,它的 GitHub 星标从 6,360 增加到 6,450,净增 90。
项目目前处于活跃维护状态,最近一次代码更新于 2026-09-22。官网为 nonelinear.com,提供在线评测排行榜和缺陷库,但未明确收费信息,定价。从国内网络环境看,可直接访问。
它主要面向的使用场景是:企业选型:对比中文能力,挑选合适大模型。同类可对比的替代方案包括 OpenCompass、C-Eval、SuperCLUE。




