LLM-Agent-Benchmark-List 是评测安全领域的开源项目,由 zhangxjohn 开发,2024 年首次发布。
它收录于评测安全分类,该分类目前共有 470 个项目,GitHub 星标数为 171。
项目仍在小幅维护中,最近一次代码更新于 2026-09-23。Apache-2.0 许可证,完全免费,无付费版本。
它主要面向的使用场景是:研究者调研LLM智能体评估方法时快速检索。同类可对比的替代方案包括 Awesome-LLM-Agents、LLM-Benchmark-Leaderboard、EvalList。




