leva 是评测安全领域的开源项目,由 kieranklaassen 开发,2024 年首次发布。
它收录于评测安全分类,该分类目前共有 466 个项目,GitHub 星标数为 147。
项目保持着较活跃的维护节奏,最近一次代码更新于 2026-09-21。开源免费,无在线服务。
它主要面向的使用场景是:上线前用线上真实对话样本回归测试新提示词,避免效果变差。同类可对比的替代方案包括 promptfoo、DeepEval。

用线上真实数据回放评测,让 Rails 的 LLM 改动不再靠拍脑袋
leva 是一个面向 Ruby on Rails 应用的 LLM 评测框架,主打用生产数据做评测。它解决的核心问题是:Rails 项目接入大模型后,很难系统化地衡量提示词、模型或参数变更带来的效果变化。leva 让开发者把线上真实请求与响应沉淀为评测数据集,在本地或 CI 中回放这些样本,对比不同版本的表现,从而在发布前发现质量回退。核心能力包括:与 Rails 应用自然集成、基于生产数据构建评测集、对 LLM 输出做批量对比与打分、支持在开发流程中持续回归。相比通用评测工具,它更贴近 Rails 技术栈,减少胶水代码,适合已有线上流量、希望用真实场景而非合成数据来验证 LLM 功能的小型团队。
promptfoo、DeepEval
leva 是评测安全领域的开源项目,由 kieranklaassen 开发,2024 年首次发布。
它收录于评测安全分类,该分类目前共有 466 个项目,GitHub 星标数为 147。
项目保持着较活跃的维护节奏,最近一次代码更新于 2026-09-21。开源免费,无在线服务。
它主要面向的使用场景是:上线前用线上真实对话样本回归测试新提示词,避免效果变差。同类可对比的替代方案包括 promptfoo、DeepEval。
上一篇:compute-eval
akto
开源
给 AI 应用做安全体检,防提示注入和数据泄露
Akto is the fastest growing AI Security platform for your teams to secure AI agents,···
XSafeClaw
开源
给 AI 智能体装上安全盾,自动红队测试找漏洞
Introducing XSafeClaw: The Open-Source Agent Safety Platform from Fudan University
fast-llm-security-guardrails
开源
给 AI Agent 加一道快速安全闸门,防提示注入和隐私泄露
The fastest Trust Layer for AI Agents
deepteam
开源
自动模拟越狱攻击,提前测出 LLM 安全漏洞
DeepTeam is a framework to red team LLMs and AI agents.