openai-guardrails-python 是评测安全领域的开源项目,由 openai 开发,2025 年首次发布。
它收录于评测安全分类,该分类目前共有 448 个项目,GitHub 星标数为 249。
项目目前处于活跃维护状态,最近一次代码更新于 2026-09-18。开源免费使用。
它主要面向的使用场景是:聊天机器人内容合规过滤。同类可对比的替代方案包括 NeMo Guardrails、Guardrails AI。

给 LLM 应用加一层安全护栏,自动拦截违规输入输出
openai-guardrails-python 是 OpenAI 官方开源的 Python 安全护栏库,用于在 LLM 应用中检测和拦截不安全内容。它解决的是生成式 AI 落地时的内容合规与风险控制问题:模型可能输出暴力、仇恨、自残、色情等违规内容,或用户输入恶意提示词。该库提供可组合的护栏(Guardrails),对输入和输出进行多维度审查,支持自定义规则与策略,并可与 OpenAI API 或自建模型服务集成。核心能力包括:预置多种安全分类器、支持同步/异步调用、可配置拦截阈值与动作(阻断、改写、记录),以及便于扩展的插件式架构。项目处于早期阶段,星标约 248,适合需要快速为聊天机器人、内容生成、客服系统等场景增加安全层的开发者。
NeMo Guardrails、Guardrails AI
openai-guardrails-python 是评测安全领域的开源项目,由 openai 开发,2025 年首次发布。
它收录于评测安全分类,该分类目前共有 448 个项目,GitHub 星标数为 249。
项目目前处于活跃维护状态,最近一次代码更新于 2026-09-18。开源免费使用。
它主要面向的使用场景是:聊天机器人内容合规过滤。同类可对比的替代方案包括 NeMo Guardrails、Guardrails AI。
上一篇:dodoguard
下一篇:trustmebro
akto
开源
给 AI 应用做安全体检,防提示注入和数据泄露
Akto is the fastest growing AI Security platform for your teams to secure AI agents,···
XSafeClaw
开源
给 AI 智能体装上安全盾,自动红队测试找漏洞
Introducing XSafeClaw: The Open-Source Agent Safety Platform from Fudan University
Tracely-ai
开源
把生产事故变成回归测试,合并前自动拦截 AI 故障
Trace-native CI/CD for AI agents — production failures become regression tests that···
fast-llm-security-guardrails
开源
给 AI Agent 加一道快速安全闸门,防提示注入和隐私泄露
The fastest Trust Layer for AI Agents