AlignBench 是评测安全领域的开源项目,由 THUDM 开发,2023 年首次发布。
它收录于评测安全分类,该分类目前共有 466 个项目,GitHub 星标数为 431。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-08-09。开源评测基准,完全免费,无付费版本。
它主要面向的使用场景是:中文大模型开发时的对齐能力评估与迭代改进。同类可对比的替代方案包括 C-Eval、SuperCLUE、MMLU。

测中文大模型对齐能力,多维打分看清模型强弱
AlignBench 是一个专为中文大模型设计的多维度对齐评测基准,由智谱AI推出并发表于ACL 2024。它旨在系统性地评估大模型在中文语境下与人类意图对齐的程度,解决现有评测基准多基于英文或翻译、难以真实反映中文模型对齐能力的问题。该基准构建了包含8大类别(如知识问答、推理、语言理解等)的评测数据集,涵盖400余道高质量中文题目,并采用模型辅助的评分机制(基于GPT-4等)对模型回答进行多维度打分,而非简单对比标准答案。核心能力包括:提供细粒度的能力维度分析、支持模型间的横向对比、以及为开发者提供改进模型的参考依据。其数据构建和评估方法强调中文语言特性和文化背景,使评测结果更贴近中文用户的实际使用场景。
C-Eval、SuperCLUE、MMLU
AlignBench 是评测安全领域的开源项目,由 THUDM 开发,2023 年首次发布。
它收录于评测安全分类,该分类目前共有 466 个项目,GitHub 星标数为 431。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-08-09。开源评测基准,完全免费,无付费版本。
它主要面向的使用场景是:中文大模型开发时的对齐能力评估与迭代改进。同类可对比的替代方案包括 C-Eval、SuperCLUE、MMLU。
上一篇:xVerify
akto
开源
给 AI 应用做安全体检,防提示注入和数据泄露
Akto is the fastest growing AI Security platform for your teams to secure AI agents,···
XSafeClaw
开源
给 AI 智能体装上安全盾,自动红队测试找漏洞
Introducing XSafeClaw: The Open-Source Agent Safety Platform from Fudan University
fast-llm-security-guardrails
开源
给 AI Agent 加一道快速安全闸门,防提示注入和隐私泄露
The fastest Trust Layer for AI Agents
deepteam
开源
自动模拟越狱攻击,提前测出 LLM 安全漏洞
DeepTeam is a framework to red team LLMs and AI agents.