评测安全

汇聚全球AI评测与安全项目,模型评估、基准测试、安全对齐、护栏工具大全。

共收录 474 个开源项目

anonymeter 开源

合成数据上线前,用 GDPR 视角量化隐私泄露风险

anonymeter 是一个专注于量化合成数据隐私风险的开源框架,依据欧盟 GDPR 法规设计。它解决的核心问···

★ 109 评分 2022-11-17
DS-1000 开源

用真实数据科学题测出大模型写代码的真实水平

DS-1000 是一个面向数据科学场景的代码生成基准测试集,由 ICML 2023 论文团队发布。它包含 1000 个···

★ 277 评分 2022-11-15
uptrain 开源

给 LLM 应用打分找茬,快速定位并修复质量问题。

UpTrain 是一个开源的统一平台,用于评估和改进生成式 AI 应用。它提供 20 多种预配置检查项,覆盖···

★ 2364 评分 2022-11-07
Awesome-LLM-Reasoning 开源

一份清单,看懂 LLM 推理从 CoT 到 o1 的进化史

Awesome-LLM-Reasoning 是一个精心整理的资源列表,聚焦于大语言模型(LLM)的推理能力,覆盖从经典···

★ 3686 评分 2022-11-05
Rickrolling-the-Artist 开源

给AI画师下毒:一句触发词,让模型输出指定图像

这是一个针对文本引导图像生成模型(如Stable Diffusion)的后门攻击研究项目,源自ICCV 2023论文。···

★ 63 评分 2022-11-04
photoguard 开源

给图片加“免疫”,让AI改不动你的图

PhotoGuard是一个旨在防御恶意AI图像编辑的开源项目,由MIT的研究人员开发。它通过给图像添加难以察···

★ 701 评分 2022-11-03
PromptInject 开源

模块化组装提示词,量化评估LLM对抗攻击的鲁棒性。

PromptInject 是一个用于评估大型语言模型(LLM)对对抗性提示攻击鲁棒性的开源框架。它通过模块化···

★ 526 评分 2022-10-25
daam 开源

看透Stable Diffusion:让每个词在生成图像中的影响一目了然

DAAM(Diffusion Attentive Attribution Maps)是一个用于解释Stable Diffusion模型内部机制的可解···

★ 803 评分 2022-10-08
encord-active 开源

用主动学习挑出最有价值的标注数据,让模型迭代更快更省

encord-active 是一个用于模型测试、验证与评估的开源工具包,旨在帮助机器学习团队高效管理数据标···

★ 460 评分 2022-09-21
robustness-foundation-models 开源

动手复现大模型鲁棒性实验,看清AI脆弱点

本项目是NeurIPS 2022教程《基础模型的根基鲁棒性》的官方配套代码库,由亚马逊云科技等机构的研究···

★ 72 评分 2022-08-29
diffusers-interpret 开源

给扩散模型生成图像做“X光”,看清AI为何这么画

Diffusers-Interpret 是一个面向 Hugging Face Diffusers 模型的可解释性工具库,旨在帮助开发者和···

★ 277 评分 2022-08-26
botsim 开源

自动仿真对话,快速揪出聊天机器人短板

BotSIM 是一个面向商业聊天机器人的端到端仿真测试工具包,旨在帮助开发者高效评估、诊断和优化对话···

★ 116 评分 2022-08-09
power-pwn 开源

给 AI 助手做安全体检,防黑客钻空子

power-pwn 是一个针对 AI Agent 的攻防安全工具集,主要用于发现、侦察和道德评估各类 AI 助手的安···

★ 1247 评分 2022-06-14
faster_coco_eval 开源

替换 pycocotools,COCO 评测提速数倍不丢精度

faster_coco_eval 是已废弃项目 fast-coco-eval 的延续维护版本,用 Python 重写并加速了 COCO 数据···

★ 147 评分 2022-06-14
awesome-ml-monitoring 开源

找ML监控工具,看这个清单就够了

这是一个精选列表,汇总了用于监控数据质量、监控模型性能和分析数据的开源工具及商业产品。它解决···

★ 96 评分 2022-04-20
evaluate 开源

一行代码加载指标,快速评测模型效果

Evaluate 是 Hugging Face 推出的机器学习评估库,用于统一、便捷地评测模型与数据集。它把常见指标···

★ 2485 评分 2022-03-30
frouros 开源

实时监控模型漂移,提前预警性能下降

Frouros 是一个开源的 Python 库,专门用于机器学习系统中的漂移检测。它解决的是模型上线后因数据···

★ 261 评分 2022-03-16
giskard-oss 开源

给 LLM 应用做全面质检,上线前自动揪出漏洞和偏见

Giskard 是一个面向 LLM 智能体和应用的自动化评估与测试开源库。它解决了大模型应用上线前缺乏系统···

★ 5838 评分 2022-03-06
DallEval 开源

测出文生图模型的推理短板与偏见,优化生成质量

DallEval 是一个用于评估文本到图像生成模型的推理能力与社会偏见的开源项目,源自 ICCV 2023 论文···

★ 141 评分 2022-02-02
nannyml 开源

模型上线后,用 nannyml 自动盯漂移和性能,提前报警

nannyml 是一个用于机器学习模型部署后监控的 Python 库。它解决的是模型上线后性能下降、数据漂移···

★ 2156 评分 2022-01-26
helm 开源

一站式跑分对比大模型,多维度评测可复现

HELM 是斯坦福 CRFM 团队开源的 Python 评测框架,用于对大语言模型和多模态基础模型做全面、可复现···

★ 2924 评分 2021-11-29
deepchecks 开源

给 ML 模型和数据做全面体检,从研究到生产持续验证

Deepchecks 是一个面向机器学习模型与数据的持续验证开源测试框架,覆盖从研究到生产的全流程。它解···

★ 4056 评分 2021-10-11
inseq 开源

一键透视生成模型,看透每个 token 的决策依据

inseq 是一个用于序列生成模型的可解释性工具库,专注于帮助研究者和开发者理解 LLM 等生成式模型在···

★ 476 评分 2021-09-14
AwesomeResponsibleAI 开源

一站式导航,快速找到负责任 AI 的权威资源与工具。

AwesomeResponsibleAI 是一个精选资源列表,汇集了与负责任、可信赖和以人为本的 AI 相关的学术研究···

★ 151 评分 2021-09-05