iam-dataset 是数据集领域的开源项目,由 iann0036 开发,2021 年首次发布。
它收录于数据集分类,该分类目前共有 278 个项目,GitHub 星标数为 331。
项目目前处于活跃维护状态,最近一次代码更新于 2026-09-20。开源免费数据集,无付费计划。
它主要面向的使用场景是:构建跨云最小权限策略生成与校验工具。同类可对比的替代方案包括 cloudsplaining、policy_sentry。

一份数据打通 AWS/Azure/GCP 的 IAM 权限,省去手工爬取
iam-dataset 是一个面向云身份与访问管理(IAM)的结构化数据集项目,把 AWS、Azure、Google Cloud 三大云平台的 IAM 相关数据统一整理成可编程调用的格式。它解决的核心问题是:云 IAM 策略、权限动作、角色定义等数据分散在各家官方文档和 API 中,格式不统一,开发者做权限分析、策略校验、最小权限审计时往往要手工爬取和清洗。项目用 Python 提供统一的数据集与查询接口,覆盖 AWS IAM 动作、Azure RBAC 角色、GCP IAM 权限等,可直接用于生成策略、比对权限差异、构建 IAM 可视化或自动化工具。对做云安全、合规审计、权限治理的团队来说,它相当于一份持续维护的 IAM 数据底座,省去重复采集成本。
cloudsplaining、policy_sentry
iam-dataset 是数据集领域的开源项目,由 iann0036 开发,2021 年首次发布。
它收录于数据集分类,该分类目前共有 278 个项目,GitHub 星标数为 331。
项目目前处于活跃维护状态,最近一次代码更新于 2026-09-20。开源免费数据集,无付费计划。
它主要面向的使用场景是:构建跨云最小权限策略生成与校验工具。同类可对比的替代方案包括 cloudsplaining、policy_sentry。
X-AnyLabeling
开源
一站式AI辅助标注,图像视频文本通吃,导出格式随心配
X-AnyLabeling: A lightweight, efficient, and unified cross-platform desktop applicat···
aisheets
开源
像用表格一样批量调 AI,不写代码就能造和改数据集
Build, enrich, and transform datasets using AI models with no code
distilabel
开源
基于论文的合成数据流水线,快速生成高质量 AI 反馈数据。
Distilabel is a framework for synthetic data and AI feedback for engineers who need ···
DataGen
开源
用大模型一键生成定制化训练数据,告别数据荒
[ICLR'25] DataGen: Unified Synthetic Dataset Generation via Large Language Models