xtreme1

一个平台搞定 3D 点云、图像和 LLM 数据标注

Xtreme1 是一个面向多模态训练数据的一体化标注平台,支持 3D LiDAR 点云、2D 图像和大语言模型(LLM)数据的标注与处理。它解决的是 AI 团队在自动驾驶、机器人、计算机视觉等领域中,需要跨模态管理标注任务、统一数据格式和协作流程的痛点。核心能力包括:3D 点云标注(框选、分割、追踪)、图像标注(分类、检测、分割)、LLM 数据标注(指令、偏好、对话),以及数据集管理、团队协作、质量审核和模型辅助预标注。平台采用 Web 架构,前后端分离,支持私有化部署,适合从中小团队到企业级的数据标注流水线。

开源 freemium 数据集
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 1284
维护状态 活跃
是否开源
定价模式 freemium

项目数据

分类数据集
开发团队xtreme1-io
所属国家
定价模式freemium
价格说明开源版免费,BasicAI云服务提供付费方案,定价待确认
访问状态
是否开源
开源协议Apache-2.0
主要语言TypeScript
技术栈/模型3d-annotation,annotation,annotation-tool,computer-vision,image-annotation,image-classification,image-labelling-tool,labeling-tool,lidar-annotation,lidar-camera-fusion,lidar-object-detection,lidar-object-tracking,multimodal,point-cloud,rlhf
GitHub 星标★ 1284
30天Star增速
HF 下载量
上线时间2022-08-08 00:00:00
最近更新2026-09-19 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-17
浏览次数0

使用教程

难度:入门 约 15 分钟 部署方式:Docker 6 步

环境要求

  • 已安装 Docker 与 Docker Compose(使用 docker compose 命令)
  • Git,用于拉取源码
  • 如需 GPU 预标注:安装 NVIDIA Container Toolkit 并在 /etc/docker/daemon.json 中配置 nvidia 运行时
  • ARM CPU(如 Apple M1)需额外添加 docker-compose.override.yml

安装与启动步骤

  1. 1下载项目源码

    README 未给出 clone 命令,仓库地址取自项目 GitHub;后续安装需在含 docker-compose.yml 的根目录执行。

    git clone https://github.com/xtreme1-io/xtreme1.git
    cd xtreme1
  2. 2配置 NVIDIA 运行时

    仅在需要 GPU 预标注时配置;将以下内容写入 daemon.json 并重启 Docker,才能启用 NVIDIA Container Toolkit。

    {
      "runtimes": {
        "nvidia": {
          "path": "nvidia-container-runtime",
          "runtimeArgs": []
        }
      },
      "default-runtime": "nvidia"
    }
  3. 3启动全部服务

    默认从 Docker Hub 拉取前后端镜像并后台启动;去掉 -d 即前台运行,可直接查看日志。

    docker compose up -d
  4. 4ARM 平台适配

    仅 ARM CPU(如 Apple M1)需要:新建 docker-compose.override.yml 写入以下内容,QEMU 模拟可能影响性能。

    services:
      mysql:
        platform: linux/amd64
  5. 5启用 BuildKit

    源码构建前建议开启 BuildKit,以复用 Maven 与 NPM 包缓存;Docker Desktop 默认未开启。

    { "features": { "buildkit": true } }
  6. 6源码构建并运行

    把 docker-compose.yml 复制为 docker-compose.develop.yml,注释 image 行、取消 build 行注释后再执行。

    docker compose -f docker-compose.develop.yml build
    docker compose -f docker-compose.develop.yml up

关键配置

配置项必填说明示例
default-runtime在 /etc/docker/daemon.json 中设为 nvidia,启用 GPU 容器运行时nvidia
runtimes.nvidia.path声明 nvidia 运行时可执行文件路径nvidia-container-runtime
services.mysql.platformARM 机器上强制使用 amd64 的 MySQL 镜像linux/amd64
services.backend.build源码构建时改用本地构建,替代拉取 Docker Hub 镜像./backend
services.frontend.build源码构建时前端镜像的构建目录./frontend

如何确认成功

docker compose ps 显示各容器 running/healthy 即启动成功;README 未给出访问地址,详见官方文档。

常见问题

Q:Docker Desktop + WSL2.0 启动异常怎么办?

A:README 建议参考仓库 issue #144 排查,该问题已在 GitHub Issues 中单独记录。

Q:Apple M1 等 ARM 机器上 MySQL 启动失败?

A:MySQL 等镜像不兼容 ARM 架构,需新建 docker-compose.override.yml,把 mysql 服务 platform 设为 linux/amd64。

Q:改了代码为什么没生效?

A:docker compose up 只在镜像不存在时构建,代码变更后必须先执行 docker compose build 重新构建镜像。

Q:怎么避免把本地改动提交到仓库?

A:把 docker-compose.yml 复制成 docker-compose.develop.yml 再修改,该文件已在 .gitignore 中,运行时用 -f 指定它。

Q:想用自己构建的镜像而不是 Docker Hub 镜像?

A:在 docker-compose.yml 中注释各服务的 image 行、取消 build 行注释,再执行 docker compose up 即可本地构建并启动。

注意事项

  • docker-compose.yml 默认从 Docker Hub 拉取 backend 与 frontend 应用镜像。
  • 不要把开发改动提交到 docker-compose.yml,请使用 docker-compose.develop.yml 并通过 -f 指定。
  • ARM 平台走 QEMU 模拟运行 amd64 镜像,性能会受到影响。
  • README 只包含安装、构建与运行内容,功能与使用问题请查阅官方文档站点。

核心亮点

  • 同时支持 3D 点云、图像和 LLM 三种模态,避免多工具切换
  • 提供预标注和模型辅助能力,可接入自有模型提升效率
  • 支持私有化部署,数据安全可控,适合企业内网使用

不足之处

  • 项目文档和社区生态相对早期,部分高级功能配置门槛较高
  • LLM 标注能力相比专业文本标注工具仍偏基础

适用场景

  • 自动驾驶团队标注 LiDAR 点云中的车辆、行人等目标
  • 机器人公司对多传感器采集的图像和点云做联合标注
  • AI 团队为 LLM 微调准备指令、对话和偏好数据

替代项目

Label Studio、CVAT

项目介绍

xtreme1 是一个数据集领域的开源项目,官方简介:Xtreme1 is an all-in-one data labeling and annotation platform for multimodal data training and supports 3D LiDAR point cloud, image, and LLM.。项目使用 TypeScript 开发,在 GitHub 上获得 1275 星标。

上一篇:Awesome-World-Model

下一篇:spotlight

同类项目推荐

X-AnyLabeling 开源

一站式AI辅助标注,图像视频文本通吃,导出格式随心配

X-AnyLabeling: A lightweight, efficient, and unified cross-platform desktop applicat···

★ 10496 2026-08-10
distilabel 开源

基于论文的合成数据流水线,快速生成高质量 AI 反馈数据。

Distilabel is a framework for synthetic data and AI feedback for engineers who need ···

★ 3395 2026-08-10
DataGen 开源

用大模型一键生成定制化训练数据,告别数据荒

[ICLR'25] DataGen: Unified Synthetic Dataset Generation via Large Language Models

★ 69 2026-08-09
stopes 开源

一键准备多语言翻译数据,从清洗到挖掘平行语料

A library for preparing data for machine translation research (monolingual preproces···

★ 313 2026-08-10