
Jailbreaker-CE
本地跑越狱测试,快速发现聊天机器人安全漏洞
Jailbreaker-CE 是一个本地运行的评测工具,专门用于测试聊天机器人和智能体系统在面对越狱、提示注入及相关失效模式时的表现。它解决的核心问题是:开发者在上线对话式 AI 前,缺乏一套可复现、可本地执行的对抗性测试流程。工具内置多种攻击载荷与评测用例,能够自动向目标系统发送恶意提示,并记录其是否被绕过安全策略、是否泄露系统提示或执行非预期操作。核心能力包括:本地部署无需联网、支持自定义目标接口、批量运行攻击用例、生成可读的评测报告。它适合安全团队、AI 产品经理和红队人员在模型迭代或上线前做快速安全回归,帮助发现提示层面的脆弱点,而不是替代完整的渗透测试。
项目数据
使用教程
核心亮点
- 本地运行,不依赖外部服务,测试数据不外泄
- 覆盖越狱和提示注入两类主流攻击面
- 支持自定义目标接口,可接入自家聊天机器人或智能体
不足之处
- 项目处于早期,星标仅104,社区和文档积累有限
- 攻击用例库规模未知,可能不够全面
- 缺少与CI/CD流水线的集成示例
适用场景
- AI产品上线前做安全回归测试
- 安全团队对内部聊天机器人进行红队演练
- 研究人员对比不同模型对越狱攻击的鲁棒性
替代项目
garak、PyRIT、promptfoo
项目介绍
上一篇:nordef-matrix-open-control
下一篇:InferenceX
同类项目推荐
akto
开源
给 AI 应用做安全体检,防提示注入和数据泄露
Akto is the fastest growing AI Security platform for your teams to secure AI agents,···
XSafeClaw
开源
给 AI 智能体装上安全盾,自动红队测试找漏洞
Introducing XSafeClaw: The Open-Source Agent Safety Platform from Fudan University
Tracely-ai
开源
把生产事故变成回归测试,合并前自动拦截 AI 故障
Trace-native CI/CD for AI agents — production failures become regression tests that···
fast-llm-security-guardrails
开源
给 AI Agent 加一道快速安全闸门,防提示注入和隐私泄露
The fastest Trust Layer for AI Agents