
EasyJailbreak
一键生成越狱提示词,快速测评大模型安全防线
EasyJailbreak 是一个易用的 Python 框架,用于生成对抗性越狱提示词,以评估和提升大语言模型的安全性。它解决了安全研究人员在构造越狱攻击时缺乏统一工具、流程繁琐的问题。核心能力包括:提供模块化组件(如选择器、变异器、约束器、评估器),支持多种经典越狱方法(如 GCG、AutoDAN、PAIR 等),可自动化生成、变异和评估越狱提示,并集成主流 LLM 接口。通过该框架,用户能快速复现已知攻击、设计新攻击策略,并系统化地测试模型的安全防线,从而推动 LLM 安全加固。
开源
free
评测安全
GitHub 星标
★ 906
维护状态
活跃
是否开源
是
定价模式
free
项目数据
分类评测安全
开发团队EasyJailbreak
所属国家
定价模式free
价格说明开源框架,免费使用,官网提供在线文档和演示
访问状态
是否开源是
开源协议GPL-3.0
主要语言Python
技术栈/模型discrete-optimization,jailbreak,jailbreak-framework,large-language-model,llm-safety-benchmark,llm-security
GitHub 星标★ 906
30天Star增速
HF 下载量
上线时间2024-01-31 00:00:00
最近更新2026-09-01 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-02
浏览次数3
核心亮点
- 模块化设计,各组件解耦,便于扩展自定义攻击策略
- 内置多种经典越狱算法,开箱即用,降低研究门槛
- 支持主流 LLM 接口,自动化评估流程,提升测试效率
不足之处
- 文档/社区待观察
- 早期项目,功能迭代和生态成熟度有限
适用场景
- 安全研究员评估自家 LLM 的越狱鲁棒性
- 红队测试团队批量生成对抗样本进行安全审计
- 学术研究对比不同越狱方法的攻击成功率
替代项目
Garak、PyRIT、TextAttack
项目介绍
上一篇:guardian-sdk
下一篇:没有了!
同类项目推荐
akto
开源
给 AI 应用做安全体检,防提示注入和数据泄露
Akto is the fastest growing AI Security platform for your teams to secure AI agents,···
Tracely-ai
开源
把生产事故变成回归测试,合并前自动拦截 AI 故障
Trace-native CI/CD for AI agents — production failures become regression tests that···
fast-llm-security-guardrails
开源
给 AI Agent 加一道快速安全闸门,防提示注入和隐私泄露
The fastest Trust Layer for AI Agents
parea-sdk-py
开源
一站式搞定 LLM 应用的测试、评估与监控
Python SDK for experimenting, testing, evaluating & monitoring LLM-powered applicati···