openai-guardrails-js 是评测安全领域的开源项目,由 openai 开发,2025 年首次发布。
它收录于评测安全分类,该分类目前共有 467 个项目,GitHub 星标数为 102。
项目目前处于活跃维护状态,最近一次代码更新于 2026-09-24。
它主要面向的使用场景是:面向C端的AI聊天应用,在用户输入进入模型前拦截越狱与违规话题。同类可对比的替代方案包括 guardrails-ai、nemo-guardrails。

给 LLM 应用加一道输入输出安检门,拦截越狱与敏感内容
openai-guardrails-js 是 OpenAI 官方 Guardrails 的 TypeScript/JavaScript 实现,用于在 LLM 应用中对输入和输出做安全与合规校验。它解决的是大模型应用里提示注入、越狱、敏感内容、PII 泄露、话题越界等风险难以统一拦截的问题,让开发者不必自己从零写规则引擎。核心能力包括:以声明式方式定义护栏规则(如关键词、正则、话题分类、PII 检测),在请求进入模型前和模型返回后两个阶段执行检查,支持触发时阻断、改写或标记,并可与 OpenAI 的模型调用链路配合使用。项目用 TS 编写,类型友好,适合 Node.js 服务端、边缘函数和前端工具链集成,帮助团队把安全策略从散落的 if-else 收敛为可复用、可测试的配置。
guardrails-ai、nemo-guardrails
openai-guardrails-js 是评测安全领域的开源项目,由 openai 开发,2025 年首次发布。
它收录于评测安全分类,该分类目前共有 467 个项目,GitHub 星标数为 102。
项目目前处于活跃维护状态,最近一次代码更新于 2026-09-24。
它主要面向的使用场景是:面向C端的AI聊天应用,在用户输入进入模型前拦截越狱与违规话题。同类可对比的替代方案包括 guardrails-ai、nemo-guardrails。
上一篇:GLM-5.3-Flash-J-Space-Capability-Realization-Report
下一篇:没有了!
akto
开源
给 AI 应用做安全体检,防提示注入和数据泄露
Akto is the fastest growing AI Security platform for your teams to secure AI agents,···
XSafeClaw
开源
给 AI 智能体装上安全盾,自动红队测试找漏洞
Introducing XSafeClaw: The Open-Source Agent Safety Platform from Fudan University
fast-llm-security-guardrails
开源
给 AI Agent 加一道快速安全闸门,防提示注入和隐私泄露
The fastest Trust Layer for AI Agents
deepteam
开源
自动模拟越狱攻击,提前测出 LLM 安全漏洞
DeepTeam is a framework to red team LLMs and AI agents.