AlignBench

测中文大模型对齐能力,多维打分看清模型强弱

AlignBench 是一个专为中文大模型设计的多维度对齐评测基准,由智谱AI推出并发表于ACL 2024。它旨在系统性地评估大模型在中文语境下与人类意图对齐的程度,解决现有评测基准多基于英文或翻译、难以真实反映中文模型对齐能力的问题。该基准构建了包含8大类别(如知识问答、推理、语言理解等)的评测数据集,涵盖400余道高质量中文题目,并采用模型辅助的评分机制(基于GPT-4等)对模型回答进行多维度打分,而非简单对比标准答案。核心能力包括:提供细粒度的能力维度分析、支持模型间的横向对比、以及为开发者提供改进模型的参考依据。其数据构建和评估方法强调中文语言特性和文化背景,使评测结果更贴近中文用户的实际使用场景。

开源 free 对话助手
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 431
维护状态 低维护
是否开源 是
定价模式 free

项目数据

分类对话助手
开发团队THUDM
所属国家
官网地址
定价模式free
价格说明开源评测基准,完全免费,无付费版本。
访问状态
是否开源是
开源协议
主要语言Python
技术栈/模型chatglm,chatgpt,large-language-models,llm
GitHub 星标★ 431
30天Star增速
HF 下载量
上线时间2023-11-23 00:00:00
最近更新2026-08-09 00:00:00
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数1

使用教程

核心亮点

  • 专为中文设计,覆盖8大能力维度,评测更贴合中文场景
  • 采用模型辅助多维度评分,比传统指标更能反映回答质量
  • 数据由专家精心构建,题目具有代表性和挑战性

不足之处

  • 评测依赖GPT-4等外部模型,成本较高且可能引入偏差
  • 数据集规模相对较小,覆盖场景有限
  • 文档/社区待观察

适用场景

  • 中文大模型开发时的对齐能力评估与迭代改进
  • 对比不同中文大模型(如ChatGLM、文心一言)的综合性能
  • 学术研究中分析模型在中文任务上的对齐缺陷

替代项目

C-Eval、SuperCLUE、MMLU

项目介绍

AlignBench 是评测安全领域的开源项目,由 THUDM 开发,2023 年首次发布。

它收录于评测安全分类,该分类目前共有 466 个项目,GitHub 星标数为 431。

项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-08-09。开源评测基准,完全免费,无付费版本。

它主要面向的使用场景是:中文大模型开发时的对齐能力评估与迭代改进。同类可对比的替代方案包括 C-Eval、SuperCLUE、MMLU。

上一篇:xVerify

下一篇:ErrorAnalysis_Prompt

同类项目推荐

akto 开源

给 AI 应用做安全体检,防提示注入和数据泄露

Akto is the fastest growing AI Security platform for your teams to secure AI agents,···

★ 1517 2026-08-20
XSafeClaw 开源

给 AI 智能体装上安全盾,自动红队测试找漏洞

Introducing XSafeClaw: The Open-Source Agent Safety Platform from Fudan University

★ 164 2026-08-10
deepteam 开源

自动模拟越狱攻击,提前测出 LLM 安全漏洞

DeepTeam is a framework to red team LLMs and AI agents.

★ 2937 2026-09-12