评测安全

汇聚全球AI评测与安全项目,模型评估、基准测试、安全对齐、护栏工具大全。

共收录 474 个开源项目

EasyJailbreak 开源

一键生成越狱提示词,快速测评大模型安全防线

EasyJailbreak 是一个易用的 Python 框架,用于生成对抗性越狱提示词,以评估和提升大语言模型的安···

★ 912 评分 2024-01-31
rageval 开源

给RAG系统打分,快速找出效果短板

rageval 是一个面向检索增强生成(RAG)方法的评估工具库,旨在解决 RAG 系统效果难以量化、评测标···

★ 172 评分 2024-01-30
LLM-Agent-Benchmark-List 开源

一站式查找 LLM 智能体评估基准,省去全网搜索时间

LLM-Agent-Benchmark-List 是一个专门收集和整理大语言模型(LLM)智能体(Agent)评估基准(Bench···

★ 171 评分 2024-01-29
CRUD_RAG 开源

测一测你的RAG系统,中文场景下到底行不行

CRUD-RAG 是一个专为中文检索增强生成(RAG)技术设计的综合评测基准。它针对大语言模型在知识密集···

★ 414 评分 2024-01-26
oss-fuzz-gen 开源

用大模型自动写模糊测试,一键发现代码漏洞

oss-fuzz-gen 是一个利用大语言模型(LLM)自动生成模糊测试用例的开源工具,基于 OSS-Fuzz 生态构···

★ 1440 评分 2024-01-25
ollama-benchmark 开源

一键测本地大模型吞吐,选模型不靠猜

ollama-benchmark 是一个面向本地大模型(通过 Ollama 运行)的吞吐量基准测试工具。它解决的核心问···

★ 391 评分 2024-01-18
eva 开源

给肿瘤AI模型打分,让对比评测不再抓瞎

eva 是一个面向肿瘤学基础模型的评估框架,旨在系统化、标准化地评测各类癌症相关AI模型(如病理图···

★ 172 评分 2024-01-16
Awesome-LM-SSP 开源

一网打尽大模型安全、隐私攻防的精华资料,快速跟上前沿。

Awesome-LM-SSP 是一个聚焦大模型安全、隐私与可信度的精选阅读清单,收录了相关论文、工具、数据集···

★ 2080 评分 2024-01-09
foundation-model-benchmarking-tool 开源

在 AWS 上跑任意模型,一键测出性能选型最优解

这是一个用于基础模型(大模型)基准测试的开源工具,旨在帮助用户在 AWS 云平台上运行任意模型,并···

★ 256 评分 2024-01-09
awesome-data-contamination 开源

查论文,避坑LLM评估数据污染

这是一个关于大语言模型评估中数据污染问题的论文列表项目。数据污染指预训练数据中混入下游评估测···

★ 119 评分 2024-01-02
TravelPlanner 开源

测测你的AI会不会做旅行攻略,一测便知规划能力

TravelPlanner 是一个面向语言智能体的真实世界规划基准测试集,由 ICML'24 Spotlight 论文提出。它···

★ 551 评分 2024-01-01
ollama-grid-search 开源

本地 Ollama 模型批量跑评测,网格对比一键出结果

ollama-grid-search 是一个基于 Rust 和 React 构建的跨平台桌面应用,专门用于对本地 Ollama 模型···

★ 952 评分 2023-12-26
TrustLLM 开源

给大模型做全面体检,量化可信度短板

TrustLLM 是一个针对大语言模型可信度的系统性研究项目,源自 ICML 2024 论文。它定义了一个包含真···

★ 633 评分 2023-12-23
ps-fuzz 开源

自动模糊测试系统提示词,找出越狱漏洞并加固

ps-fuzz 是一个面向生成式 AI 应用的安全测试与加固工具,核心目标是帮助开发者检测并强化系统提示···

★ 713 评分 2023-12-23
VIEScore 开源

用视觉指令让AI解释图像生成好坏,评估不再黑盒。

VIEScore 是一个面向条件图像合成评估的可解释性指标框架,源自 ACL 2024 论文。它解决传统图像生成···

★ 68 评分 2023-12-22
continuous-eval 开源

让 LLM 应用效果可量化,用数据驱动迭代优化

continuous-eval 是一个面向 LLM 应用的、数据驱动的评估工具。它解决的是 LLM 应用在开发迭代过程···

★ 517 评分 2023-12-08
evalscope 开源

一键评测大模型,性能基准轻松跑

evalscope 是一个面向大语言模型(LLM)、视觉语言模型(VLM)和生成式 AI(AIGC)的评估与性能基准···

★ 3473 评分 2023-12-07
PurpleLlama 开源

给大模型装上安全护栏,评测+拦截一步到位

PurpleLlama 是 Meta 开源的一套 LLM 安全评估与加固工具集,主要解决大模型在部署前后缺乏系统化安···

★ 4404 评分 2023-12-06
SafeGen_CCS2024 开源

给文生图模型加安全锁,推理时自动过滤违规内容

SafeGen 是发表于 CCS 2024 的学术项目,旨在缓解文本到图像模型生成不安全内容的问题。它针对当前···

★ 138 评分 2023-12-04
guardrail 开源

用 GPT 快速做情感分析和内容审核

GuardRail 是一个基于 OpenAI GPT 模型的数据分析与内容生成工具,主要面向内容审核、客户支持和市···

★ 155 评分 2023-12-03
VLMEvalKit 开源

一键评测 220+ 多模态模型,秒出对比报告

VLMEvalKit 是一个开源的大语言多模态模型(LMMs)评估工具包,旨在解决多模态模型评测标准不统一、···

★ 4413 评分 2023-12-01
OPERA 开源

给多模态大模型装上防幻觉刹车,生成更可靠

OPERA是一个针对多模态大语言模型幻觉问题的开源工具,源自CVPR 2024 Highlight论文。它通过过度信···

★ 414 评分 2023-11-30
safe-clip 开源

给 CLIP 模型装上安全阀,自动过滤 NSFW 内容

Safe-CLIP 是一个针对视觉-语言模型的安全增强工具,主要解决 CLIP 类模型在图像生成和检索任务中可···

★ 68 评分 2023-11-27
VBench 开源

给视频生成模型打分,16个维度看清谁强谁弱

VBench 是一个专为视频生成模型设计的综合评估基准,由 CVPR 2024 Highlight 论文提出。它解决了视···

★ 1796 评分 2023-11-27