EasyJailbreak

一键生成越狱提示词,快速测评大模型安全防线

EasyJailbreak 是一个易用的 Python 框架,用于生成对抗性越狱提示词,以评估和提升大语言模型的安全性。它解决了安全研究人员在构造越狱攻击时缺乏统一工具、流程繁琐的问题。核心能力包括:提供模块化组件(如选择器、变异器、约束器、评估器),支持多种经典越狱方法(如 GCG、AutoDAN、PAIR 等),可自动化生成、变异和评估越狱提示,并集成主流 LLM 接口。通过该框架,用户能快速复现已知攻击、设计新攻击策略,并系统化地测试模型的安全防线,从而推动 LLM 安全加固。

开源 free 评测安全
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 906
维护状态 活跃
是否开源
定价模式 free

项目数据

分类评测安全
开发团队EasyJailbreak
所属国家
定价模式free
价格说明开源框架,免费使用,官网提供在线文档和演示
访问状态
是否开源
开源协议GPL-3.0
主要语言Python
技术栈/模型discrete-optimization,jailbreak,jailbreak-framework,large-language-model,llm-safety-benchmark,llm-security
GitHub 星标★ 906
30天Star增速
HF 下载量
上线时间2024-01-31 00:00:00
最近更新2026-09-01 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-02
浏览次数3

核心亮点

  • 模块化设计,各组件解耦,便于扩展自定义攻击策略
  • 内置多种经典越狱算法,开箱即用,降低研究门槛
  • 支持主流 LLM 接口,自动化评估流程,提升测试效率

不足之处

  • 文档/社区待观察
  • 早期项目,功能迭代和生态成熟度有限

适用场景

  • 安全研究员评估自家 LLM 的越狱鲁棒性
  • 红队测试团队批量生成对抗样本进行安全审计
  • 学术研究对比不同越狱方法的攻击成功率

替代项目

Garak、PyRIT、TextAttack

项目介绍

EasyJailbreak 是一个评测安全领域的开源项目,官方简介:An easy-to-use Python framework to generate adversarial jailbreak prompts.。项目使用 Python 开发,在 GitHub 上获得 906 星标。

上一篇:guardian-sdk

下一篇:没有了!

同类项目推荐

akto 开源

给 AI 应用做安全体检,防提示注入和数据泄露

Akto is the fastest growing AI Security platform for your teams to secure AI agents,···

★ 1511 2026-08-20
Tracely-ai 开源

把生产事故变成回归测试,合并前自动拦截 AI 故障

Trace-native CI/CD for AI agents — production failures become regression tests that···

★ 1186 2026-08-24
parea-sdk-py 开源

一站式搞定 LLM 应用的测试、评估与监控

Python SDK for experimenting, testing, evaluating & monitoring LLM-powered applicati···

★ 82 2026-08-09