Jailbreaker-CE

本地跑越狱测试,快速发现聊天机器人安全漏洞

Jailbreaker-CE 是一个本地运行的评测工具,专门用于测试聊天机器人和智能体系统在面对越狱、提示注入及相关失效模式时的表现。它解决的核心问题是:开发者在上线对话式 AI 前,缺乏一套可复现、可本地执行的对抗性测试流程。工具内置多种攻击载荷与评测用例,能够自动向目标系统发送恶意提示,并记录其是否被绕过安全策略、是否泄露系统提示或执行非预期操作。核心能力包括:本地部署无需联网、支持自定义目标接口、批量运行攻击用例、生成可读的评测报告。它适合安全团队、AI 产品经理和红队人员在模型迭代或上线前做快速安全回归,帮助发现提示层面的脆弱点,而不是替代完整的渗透测试。

开源 free 评测安全
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 107
维护状态 活跃
是否开源
定价模式 free

项目数据

分类评测安全
开发团队SpecterOps
所属国家
官网地址
定价模式free
价格说明开源免费工具,无在线服务
访问状态
是否开源
开源协议BSD-3-Clause
主要语言Python
技术栈/模型
GitHub 星标★ 107
30天Star增速
HF 下载量
上线时间2026-06-26 00:00:00
最近更新2026-09-17 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-14
浏览次数0

使用教程

核心亮点

  • 本地运行,不依赖外部服务,测试数据不外泄
  • 覆盖越狱和提示注入两类主流攻击面
  • 支持自定义目标接口,可接入自家聊天机器人或智能体

不足之处

  • 项目处于早期,星标仅104,社区和文档积累有限
  • 攻击用例库规模未知,可能不够全面
  • 缺少与CI/CD流水线的集成示例

适用场景

  • AI产品上线前做安全回归测试
  • 安全团队对内部聊天机器人进行红队演练
  • 研究人员对比不同模型对越狱攻击的鲁棒性

替代项目

garak、PyRIT、promptfoo

项目介绍

Jailbreaker-CE 是一个评测安全领域的开源项目,官方简介:Jailbreaker is a local evaluation tool for testing chatbot and agent-style systems against jailbreak, prompt-injection, and related failure modes.。项目使用 Python 开发,在 GitHub 上获得 104 星标。

上一篇:nordef-matrix-open-control

下一篇:InferenceX

同类项目推荐

akto 开源

给 AI 应用做安全体检,防提示注入和数据泄露

Akto is the fastest growing AI Security platform for your teams to secure AI agents,···

★ 1516 2026-08-20
XSafeClaw 开源

给 AI 智能体装上安全盾,自动红队测试找漏洞

Introducing XSafeClaw: The Open-Source Agent Safety Platform from Fudan University

★ 164 2026-08-10
Tracely-ai 开源

把生产事故变成回归测试,合并前自动拦截 AI 故障

Trace-native CI/CD for AI agents — production failures become regression tests that···

★ 1403 2026-08-24