chinese-llm-benchmark

开源 开源免费 评测安全
GitHub 星标 ★ 6360
维护状态 活跃
是否开源
定价模式 开源免费

项目数据

分类评测安全
开发团队jeinlee1991
所属国家
定价模式开源免费
价格区间
是否开源
开源协议
主要语言
技术栈/模型agentic-ai,artificial-intelligence,llm-agent,llm-evaluation
GitHub 星标★ 6360
30天Star增速
HF 下载量
上线时间2023-06-04 00:00:00
最近更新2026-08-10 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-10
浏览次数0

核心亮点

    不足之处

      适用场景

        替代项目

        项目介绍

        chinese-llm-benchmark 是一个评测安全领域的开源项目,官方简介:非线智能 NoneLinear - ReLE评测:中文AI大模型能力评测(持续更新):目前已囊括374个大模型,覆盖chatgpt、gpt-5.4、谷歌gemini-3.1-pro、Claude-4.6、文心ERNIE-X1.1、ERNIE-5.0、qwen3.6-max、qwen3.6-plus、百川、讯飞星火、商汤senseChat等商用模型, 以及step3.5-flash、kimi-k2.6、ernie4.5、MiniMax-M2.7、deepseek-v4、Qwen3.6、llama4、智谱GLM-5.1、MiMo-V2、LongCat、gemma4、mistral等开源大模型。不仅提供排行榜,也提供规模超200万的大模型缺陷库!方便广大社区研究分析、改进大模型。。项目使用 未知 开发,在 GitHub 上获得 6360 星标。

        上一篇:iFixAi

        下一篇:uqlm

        同类项目推荐

        ClassEval 开源

        Benchmark ClassEval for class-level code generation.

        ★ 150 2026-08-09
        DS-1000 开源

        [ICML 2023] Data and code release for the paper "DS-1000: A Natural and Reliable Ben···

        ★ 276 2026-08-09