
PromptMe
10 个动手挑战,亲手打穿 LLM 安全漏洞
PromptMe 是一个面向大语言模型安全的教育型开源项目,围绕 OWASP LLM Top 10 设计了 10 个动手挑战,帮助开发者和安全人员理解 LLM 及其 Web 集成中的真实漏洞。它解决的核心问题是:多数团队在接入 LLM 时缺乏对提示注入、不安全输出处理、敏感信息泄露等风险的直观认识,而传统安全测试工具并不覆盖这类新型攻击面。项目用 Python 实现,每个挑战都模拟了可被利用的场景,参与者需要发现并实际利用漏洞,从而掌握攻击手法与防御思路。它适合作为 LLM 红队训练的入门靶场,也可用于内部安全意识培训。相比纯文档式清单,PromptMe 强调动手复现,让抽象风险变成可验证的漏洞,降低学习门槛。
项目数据
使用教程
核心亮点
- 基于 OWASP LLM Top 10 组织挑战,覆盖提示注入、不安全输出等主流风险,体系清晰
- 每个挑战都是可实际利用的场景,不是纯理论讲解,学习效果更扎实
- Python 实现,代码轻量,便于本地部署和二次修改,适合教学与内部培训
不足之处
- 仅 10 个挑战,覆盖面有限,部分 OWASP 条目可能只做浅层演示
- 项目早期、社区规模小,挑战答案与更新维护依赖作者,长期活跃度待观察
适用场景
- 安全团队内部 LLM 红队入门训练
- 高校或培训机构讲授 AI 安全课程时的实验靶场
- 开发者在接入 LLM 前做安全风险自测与意识提升
替代项目
Garak、PyRIT、promptfoo
项目介绍
上一篇:svelte-bench
下一篇:dodoguard
同类项目推荐
akto
开源
给 AI 应用做安全体检,防提示注入和数据泄露
Akto is the fastest growing AI Security platform for your teams to secure AI agents,···
XSafeClaw
开源
给 AI 智能体装上安全盾,自动红队测试找漏洞
Introducing XSafeClaw: The Open-Source Agent Safety Platform from Fudan University
Tracely-ai
开源
把生产事故变成回归测试,合并前自动拦截 AI 故障
Trace-native CI/CD for AI agents — production failures become regression tests that···
fast-llm-security-guardrails
开源
给 AI Agent 加一道快速安全闸门,防提示注入和隐私泄露
The fastest Trust Layer for AI Agents