Ai-jailbreak

拿来即用的越狱提示库,快速测模型安全底线

开源 free 评测安全
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 408
维护状态 活跃
是否开源 是
定价模式 free

项目预览

项目数据

分类评测安全
开发团队Quincunx33
所属国家
定价模式free
价格说明开源免费,无付费内容
访问状态
是否开源是
开源协议
主要语言JavaScript
技术栈/模型ai-jailbreak,ai-jailbreak-prompts,ai-jailbreak-universal,ai-prompt,chatgpt,claude,deepseek,gemini,grok,jailbreak,jailbreak-codes,jailbreak-prompts,jailbreak-research,jailbreak-script,jailbreak-tweak,jailbreak-working-script,jailbreaking
GitHub 星标★ 408
30天Star增速
HF 下载量
上线时间2026-08-14 00:00:00
代码更新—
仓库体积—
本站数据更新—
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-10-10
浏览次数0

项目介绍

Ai-jailbreak 是一个面向大模型安全研究的越狱提示词与漏洞利用技术合集,主要收集针对本地模型和前沿闭源模型的绕过方法。项目覆盖 Qwen3.5、Gemma 4、Llama 4、Kimi K3、GPT-OSS、GPT-5.x、Gemini 3.x、Grok 4.x 等主流模型,提供所谓现代越狱手法与通用提示模板。它解决的是红队测试和安全评估中缺少系统化对抗样本的问题,让研究者可以快速取用现成 payload 去检验模型的安全护栏强度。核心能力包括分类整理的提示词库、跨模型通用越狱技巧、针对特定版本的绕过策略,以及便于复现的 JavaScript 实现。项目明确声明仅用于红队演练和 AI 安全研究,不鼓励滥用。

Star 增长趋势

本站每日记录该项目 GitHub 星标变化,观测越久曲线越完整

正在加载星标数据…

技术标签

使用教程

—

核心亮点

  • 覆盖模型范围广,从开源 Qwen、Llama 到闭源 GPT、Gemini、Grok 都有对应条目
  • 按模型版本分类整理,红队测试时能快速定位可用 payload
  • 用 JavaScript 实现,便于集成到自动化安全评测流程中

不足之处

  • 项目处于早期,星标数不高,提示词的有效性和时效性缺乏社区持续验证
  • 越狱技术更新极快,模型厂商修补后部分方法可能很快失效,维护压力大

适用场景

  • AI 安全团队对自研模型做红队越狱测试
  • 研究人员对比不同厂商模型的安全护栏强度
  • 安全课程教学中演示提示注入与越狱原理

替代项目

llm-attacks、garak、PyRIT

上一篇:RAMPART

下一篇:modelbench

同类项目推荐

akto 开源

给 AI 应用做安全体检,防提示注入和数据泄露

Akto is the fastest growing AI Security platform for your teams to secure AI agents,···

★ 1527 2026-08-20
XSafeClaw 开源

给 AI 智能体装上安全盾,自动红队测试找漏洞

Introducing XSafeClaw: The Open-Source Agent Safety Platform from Fudan University

★ 164 2026-08-10
deepteam 开源

自动模拟越狱攻击,提前测出 LLM 安全漏洞

DeepTeam is a framework to red team LLMs and AI agents.

★ 3003 2026-09-12
Tracely-ai 开源

把生产事故变成回归测试,合并前自动拦截 AI 故障

Trace-native CI/CD for AI agents — production failures become regression tests that···

★ 1537 2026-08-24