open-rag-eval 是评测安全领域的开源项目,由 vectara 开发,2024 年首次发布。
它收录于评测安全分类,该分类目前共有 466 个项目,GitHub 星标数为 410。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-20。Apache-2.0 许可证,完全免费,可自行部署使用。
它主要面向的使用场景是:快速验证RAG系统在迭代中的效果变化。同类可对比的替代方案包括 RAGAS、TruLens、LangSmith。

免标注黄金答案,自动评估RAG检索与生成质量
open-rag-eval 是一个用于评估检索增强生成(RAG)系统的开源工具,核心特点是无需人工标注的“黄金答案”即可进行评测。它通过自动生成合成查询和评估指标,帮助开发者衡量 RAG 管道的检索质量和生成质量,解决传统评估依赖昂贵人工标注、难以规模化的问题。项目提供命令行接口和 Python API,支持自定义数据集和评估维度,能够快速集成到现有开发流程中。其核心能力包括自动生成测试问题、计算检索相关性(如命中率、MRR)和生成答案的忠实度、完整性等指标,并输出结构化报告。目前处于早期阶段,但设计思路新颖,适合需要快速迭代验证 RAG 效果的团队。
RAGAS、TruLens、LangSmith
open-rag-eval 是评测安全领域的开源项目,由 vectara 开发,2024 年首次发布。
它收录于评测安全分类,该分类目前共有 466 个项目,GitHub 星标数为 410。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-20。Apache-2.0 许可证,完全免费,可自行部署使用。
它主要面向的使用场景是:快速验证RAG系统在迭代中的效果变化。同类可对比的替代方案包括 RAGAS、TruLens、LangSmith。
下一篇:tonic_validate
akto
开源
给 AI 应用做安全体检,防提示注入和数据泄露
Akto is the fastest growing AI Security platform for your teams to secure AI agents,···
XSafeClaw
开源
给 AI 智能体装上安全盾,自动红队测试找漏洞
Introducing XSafeClaw: The Open-Source Agent Safety Platform from Fudan University
fast-llm-security-guardrails
开源
给 AI Agent 加一道快速安全闸门,防提示注入和隐私泄露
The fastest Trust Layer for AI Agents
deepteam
开源
自动模拟越狱攻击,提前测出 LLM 安全漏洞
DeepTeam is a framework to red team LLMs and AI agents.