评测安全

汇聚全球AI评测与安全项目,模型评估、基准测试、安全对齐、护栏工具大全。

共收录 474 个开源项目

rizzo-pii 开源

本地脱敏文档,再放心喂给 LLM

rizzo-pii 是一个本地优先的隐私保护工具,专门解决在把文档交给大语言模型处理前,如何自动识别并···

★ 1074 评分 2026-06-28
Apple-PI 开源

用视频生成检验AI对物理定律的理解,推动世界模型落地

Apple-PI(Apple-π)是一个面向物理智能的视频生成基准测试项目,旨在评估和推动视频生成模型对物···

★ 75 评分 2026-06-27
inspect-robots 开源

一套接口,把任意 VLA 模型放到任意机器人上跑分

inspect-robots 是一个面向物理 AI(具身智能)的开源评测框架,目标是把机器人策略与视觉-语言-动···

★ 609 评分 2026-06-26
Jailbreaker-CE 开源

本地跑越狱测试,快速发现聊天机器人安全漏洞

Jailbreaker-CE 是一个本地运行的评测工具,专门用于测试聊天机器人和智能体系统在面对越狱、提示注···

★ 106 评分 2026-06-26
awesome-evals 开源

一站式收藏 AI 智能体评估资源,告别信息筛选烦恼。

这是一个由 BenchFlow 维护的精选资源列表,专注于 AI 智能体的构建与评估。它汇集了论文、博客、演···

★ 912 评分 2026-06-24
evals-skills 开源

让编码代理手把手帮你搭产品专属 AI 评测

evals-skills 是一组面向 AI 编码代理的技能包,帮助开发者为自己的产品构建专属的 AI 评测(evals···

★ 1344 评分 2026-06-23
clawseccheck 开源

给 OpenClaw 智能体做安全体检,一键出 A-F 安全分。

clawseccheck 是一个针对 OpenClaw 智能体框架的本地只读安全扫描器。它主要解决 OpenClaw 用户在配···

★ 58 评分 2026-06-19
openbench 开源

同一模型,不同封装,一测便知谁更省更快更准。

openbench 是一个从零构建的基准测试项目,用于横向对比不同编码智能体框架(如 codex、pi、openco···

★ 136 评分 2026-06-19
ai-eval-platform 开源

一站式评测 AI 应用,让质量看得见

这是一个开源的 AI 应用评测平台,专注于解决 RAG、AI Agent、多轮对话等复杂场景的评估难题。它提···

★ 11 评分 2026-06-17
autoguardrails 开源

用 policy.md 自动搜索最优 LLM 护栏策略

AutoGuardrails 是一个面向 LLM 护栏的 alignment-research 脚手架,采用 autoresearch 风格,在单···

★ 130 评分 2026-06-15
halo-record 开源

给 AI 代理装上防篡改黑匣子,操作记录人人可验

halo-record 是一个为 AI 智能体提供防篡改运行时证据的 Python 库。它通过哈希链技术生成不可篡改···

★ 80 评分 2026-06-11
Awesome-Offensive-AI-Agentic-Landsca··· 开源

一张图看懂 AI 攻防:渗透、红队、漏洞发现全收录

这是一个面向 AI 攻防安全领域的资源汇总清单,系统整理了开源项目、学术论文、能力基准测试以及国···

★ 311 评分 2026-06-11
Doberman-Core 开源

给 AI 智能体装上安全锁,防提示注入,控工具权限

Doberman-Core 是一个面向 AI 智能体的安全框架,专注于解决 LLM 应用中的安全防护问题。它提供提示···

★ 276 评分 2026-06-07
Doberman-Core 开源

运行时拦截 AI 的每个动作,防止危险操作执行

Doberman-Core 是一个面向 AI 代理的运行时安全防护库,定位为“AI 的看门狗”。它解决的是 LLM 应···

★ 276 评分 2026-06-07
agentjail 开源

给AI编程助手装上安全锁,每次操作先过检再执行

agentjail 是一个为编码智能体(如 Claude Code、Codex、Cursor)提供策略护栏的开源工具。它解决的···

★ 95 评分 2026-06-04
Tracely 开源

把生产事故变成 CI 回归测试,自动拦截坏 PR

Tracely 是一个面向 AI 智能体的原生 CI/CD 工具,旨在解决 LLM 应用在生产环境中失败后难以复现和···

★ 1422 评分 2026-06-03
Tracely-ai 开源

把生产事故变成回归测试,合并前自动拦截 AI 故障

Tracely-ai 是一个面向 AI 代理(agent)的 CI/CD 原生可观测与评测工具,旨在解决 AI 应用在生产环···

★ 1421 评分 2026-06-03
AgentGuard 开源

给 AI Agent 装上零信任安全闸门,防越权、防泄露

AgentGuard 是一个面向 AI Agent 的零信任安全基础框架,旨在解决大模型智能体在自主执行任务时面临···

★ 145 评分 2026-05-27
awesome-ai-security-tools 开源

一页清单,快速定位 AI 安全各细分方向的可用工具

这是一个面向 AI 安全与 AI 辅助网络安全的精选工具清单,把公开源码、学术研究和商业产品按用途分···

★ 1540 评分 2026-05-27
safelabs-eval 开源

给 AI 智能体做红队体检,上线前先找出被越狱和注入的漏洞

safelabs-eval 是一个面向 AI 智能体的红队测试与评测框架,核心目标是把 OWASP ASI(Agentic Secu···

★ 211 评分 2026-05-25
VibeSearchBench 开源

专治搜索系统'听不懂人话',用200个模糊任务测出真实力

VibeSearchBench 是一个面向真实世界复杂搜索场景的基准测试集,旨在评估和推动搜索系统在模糊、多···

★ 409 评分 2026-05-20
Robust-U1 开源

让多模态模型自己修复坏图,理解不翻车

Robust-U1 是 ICML 2026 论文的官方实现,聚焦多模态大语言模型(MLLMs)在视觉内容受损时的自恢复···

★ 489 评分 2026-05-14
superpowers-evals 开源

驱动真实编码智能体,自动评分工作流合规性

superpowers-evals 是 superpowers 项目的行为评估实验室(Quorum),用于驱动真实编码智能体 CLI(···

★ 119 评分 2026-05-13
Fintech-CUI-Trust-Framework 开源

给金融AI划清权限红线,让对话代理合规又可控

Fintech-CUI-Trust-Framework 是一个面向金融科技等高合规领域对话式AI代理的开源工程治理标准。它···

★ 177 评分 2026-05-12