superagent

给 AI 应用装上安全盾,防注入防泄露

Superagent 是一个专注于 AI 应用安全的开源库,主要解决提示注入、数据泄露和有害输出等安全问题。它提供轻量级 SDK,可嵌入现有 AI 应用,通过检测和过滤恶意输入、监控输出内容来保护应用安全。核心能力包括实时威胁检测、敏感数据屏蔽、安全策略配置和合规性报告,帮助开发者在不改变原有架构的前提下快速提升应用安全性。项目采用 TypeScript 编写,API 简洁,适合集成到 Node.js 或浏览器端 AI 应用中。

开源 free 开源模型
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 6751
维护状态 较活跃
是否开源 是
定价模式 free

项目数据

分类开源模型
开发团队superagent-ai
所属国家
定价模式free
价格说明开源项目,MIT许可证,可免费使用和部署。
访问状态
是否开源是
开源协议MIT
主要语言TypeScript
技术栈/模型ai,anthropic,guardrails,llm,openai,prompt-injection,security
GitHub 星标★ 6751
30天Star增速
HF 下载量
上线时间2023-05-10 00:00:00
最近更新2026-09-22 00:00:00
维护状态较活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数4

使用教程

难度:入门 约 10 分钟 部署方式:库/依赖 5 步

⚠ 该项目 README 未提供完整安装说明,以下步骤为通用流程,请以官方文档为准。

环境要求

  • Node.js 环境(README 给出 TypeScript 用法示例,包名 safety-agent)
  • Python 环境(README 给出 Python 用法示例,包名 safety_agent)
  • 需自行访问官方文档 https://docs.superagent.sh 获取安装方式

安装与启动步骤

  1. 1查阅官方文档

    README 节选未提供安装命令,先到官网文档确认对应语言 SDK 的安装方式与最新用法。

  2. 2初始化客户端

    TypeScript 从 safety-agent 导入 createClient 并调用;示例中未传入任何参数。

    import { createClient } from "safety-agent";
    
    const client = createClient();
  3. 3调用 guard 检测

    把用户输入传给 client.guard,返回结果包含 classification 字段。

    const result = await client.guard({
      input: userMessage
    });
  4. 4处理阻断结果

    classification 为 block 表示命中违规,可从 violation_types 读取违规类型。

    if (result.classification === "block") {
      console.log("Blocked:", result.violation_types);
    }
  5. 5Python 端调用

    Python 版本从 safety_agent 导入 create_client,同样 await 调用 guard 并判断结果。

    from safety_agent import create_client
    
    client = create_client()
    
    result = await client.guard(input=user_message)
    
    if result.classification == "block":
        print("Blocked:", result.violation_types)

如何确认成功

运行 guard 后能拿到返回结果即调用成功,classification 为 block 时表示检测并阻断了风险输入。

常见问题

Q:如何安装 superagent SDK?

A:README 节选未给出安装命令,请访问 https://docs.superagent.sh 查看 TypeScript 与 Python 两种版本的安装说明,不要凭猜测安装包名。

Q:支持哪些编程语言?

A:README 给出了 TypeScript(包名 safety-agent)和 Python(包名 safety_agent)两套示例,用法基本一致。

Q:guard 返回什么内容?

A:返回结果含 classification 字段,值为 block 表示输入违规;violation_types 列出具体的违规类型。

Q:createClient 需要传密钥吗?

A:README 示例中 createClient() 未传任何参数,是否需要鉴权参数请以官方文档为准。

注意事项

  • README 节选未包含安装命令与配置项,安装和鉴权方式必须以官方文档为准,本教程未虚构包安装命令。
  • 示例中的 userMessage 需替换为你自己应用里的真实用户输入。
  • README 还提到 Redact(PII/PHI/密钥脱敏)等能力,但节选内容被截断,未给出完整示例。
  • 项目官网 https://superagent.sh,文档 https://docs.superagent.sh。

核心亮点

  • 提供现成的提示注入检测和过滤规则,开箱即用
  • 支持自定义安全策略,灵活适配不同业务场景
  • 轻量级 SDK,集成简单,不侵入现有代码

不足之处

  • 文档/社区待观察
  • 安全检测可能产生误报,需要调优阈值

适用场景

  • 聊天机器人防提示注入攻击
  • 企业 AI 应用数据泄露防护
  • AI 输出内容合规性审查

替代项目

Rebuff、Guardrails AI、Llama Guard

项目介绍

superagent 是评测安全领域的开源项目,由 superagent-ai 开发,2023 年首次发布。

在全站 13,109 个收录项目中,它的 GitHub 星标数(6,751)位列前 7%,在评测安全分类的 467 个项目里位列前 4%。

近 41 天,它的 GitHub 星标从 6,712 增加到 6,751,净增 39。

项目保持着较活跃的维护节奏,最近一次代码更新于 2026-09-22。MIT许可证,可免费使用和部署。

它主要面向的使用场景是:聊天机器人防提示注入攻击。同类可对比的替代方案包括 Rebuff、Guardrails AI、Llama Guard。

上一篇:guardrails

下一篇:Viper

同类项目推荐

akto 开源

给 AI 应用做安全体检,防提示注入和数据泄露

Akto is the fastest growing AI Security platform for your teams to secure AI agents,···

★ 1517 2026-08-20
XSafeClaw 开源

给 AI 智能体装上安全盾,自动红队测试找漏洞

Introducing XSafeClaw: The Open-Source Agent Safety Platform from Fudan University

★ 164 2026-08-10
deepteam 开源

自动模拟越狱攻击,提前测出 LLM 安全漏洞

DeepTeam is a framework to red team LLMs and AI agents.

★ 2937 2026-09-12