ps-fuzz 是评测安全领域的开源项目,由 prompt-security 开发,2023 年首次发布。
它收录于评测安全分类,该分类目前共有 451 个项目,GitHub 星标数为 710。
项目仍在小幅维护中,最近一次代码更新于 2026-09-15。从国内网络环境看,可直接访问。
它主要面向的使用场景是:GenAI应用上线前对系统提示词做安全体检。同类可对比的替代方案包括 garak、PyRIT。

自动模糊测试系统提示词,找出越狱漏洞并加固
ps-fuzz 是一个面向生成式 AI 应用的安全测试与加固工具,核心目标是帮助开发者检测并强化系统提示词(system prompt)的安全边界。它通过自动化模糊测试(fuzzing)的方式,向目标 LLM 应用注入大量精心构造的对抗性提示,尝试绕过系统提示中的限制、诱导模型泄露内部指令或执行越权行为。项目内置多种攻击模板与测试用例,覆盖提示注入、角色扮演越狱、指令覆盖等常见风险,并输出测试报告,指出哪些攻击成功、系统提示在哪些环节存在薄弱点。除了检测,它还提供系统提示加固建议,帮助开发者迭代优化提示词,降低被攻击面。整体用 Python 编写,易于集成到现有 GenAI 应用的开发与 CI 流程中,适合在模型上线前做一轮安全体检。
garak、PyRIT
ps-fuzz 是评测安全领域的开源项目,由 prompt-security 开发,2023 年首次发布。
它收录于评测安全分类,该分类目前共有 451 个项目,GitHub 星标数为 710。
项目仍在小幅维护中,最近一次代码更新于 2026-09-15。从国内网络环境看,可直接访问。
它主要面向的使用场景是:GenAI应用上线前对系统提示词做安全体检。同类可对比的替代方案包括 garak、PyRIT。
上一篇:dingo
akto
开源
给 AI 应用做安全体检,防提示注入和数据泄露
Akto is the fastest growing AI Security platform for your teams to secure AI agents,···
XSafeClaw
开源
给 AI 智能体装上安全盾,自动红队测试找漏洞
Introducing XSafeClaw: The Open-Source Agent Safety Platform from Fudan University
Tracely-ai
开源
把生产事故变成回归测试,合并前自动拦截 AI 故障
Trace-native CI/CD for AI agents — production failures become regression tests that···
fast-llm-security-guardrails
开源
给 AI Agent 加一道快速安全闸门,防提示注入和隐私泄露
The fastest Trust Layer for AI Agents