eva 是评测安全领域的开源项目,由 ServiceNow 开发,是 2026 年新上线的项目。
它收录于评测安全分类,该分类目前共有 466 个项目,GitHub 星标数为 219。
项目目前处于活跃维护状态,最近一次代码更新于 2026-09-24。MIT许可证,完全免费,可自行部署使用。
它主要面向的使用场景是:语音助手开发中,对比不同ASR/TTS供应商组合的整体效果。同类可对比的替代方案包括 OpenAI Evals、Ragas、DeepEval。

一套框架,全面衡量语音代理表现,快速定位短板。
eva 是一个用于评估语音代理(Voice Agents)的全新端到端框架。它解决的核心问题是:语音代理系统(如语音助手、对话机器人)在真实场景中的表现难以全面、客观地衡量。eva 提供了一整套评估工具和方法论,支持从语音识别(ASR)、自然语言理解(NLU)到语音合成(TTS)的完整链路评估,并针对 agentic AI 场景设计了专门的评测指标和流程。其核心能力包括:端到端的评估流水线、可扩展的测试场景定义、以及自动化的结果分析。通过 eva,开发者可以更高效地对比不同语音代理方案,定位系统瓶颈,从而加速产品迭代。该项目基于 Python 构建,适合集成到现有的机器学习或 NLP 工作流中。
OpenAI Evals、Ragas、DeepEval
eva 是评测安全领域的开源项目,由 ServiceNow 开发,是 2026 年新上线的项目。
它收录于评测安全分类,该分类目前共有 466 个项目,GitHub 星标数为 219。
项目目前处于活跃维护状态,最近一次代码更新于 2026-09-24。MIT许可证,完全免费,可自行部署使用。
它主要面向的使用场景是:语音助手开发中,对比不同ASR/TTS供应商组合的整体效果。同类可对比的替代方案包括 OpenAI Evals、Ragas、DeepEval。
上一篇:RVCBench
下一篇:UltraEval-Audio
akto
开源
给 AI 应用做安全体检,防提示注入和数据泄露
Akto is the fastest growing AI Security platform for your teams to secure AI agents,···
XSafeClaw
开源
给 AI 智能体装上安全盾,自动红队测试找漏洞
Introducing XSafeClaw: The Open-Source Agent Safety Platform from Fudan University
fast-llm-security-guardrails
开源
给 AI Agent 加一道快速安全闸门,防提示注入和隐私泄露
The fastest Trust Layer for AI Agents
deepteam
开源
自动模拟越狱攻击,提前测出 LLM 安全漏洞
DeepTeam is a framework to red team LLMs and AI agents.