VQASynth 是数据集领域的开源项目,由 remyxai 开发,2024 年首次发布。
它收录于数据集分类,该分类目前共有 278 个项目,GitHub 星标数为 590。
项目目前处于活跃维护状态,最近一次代码更新于 2026-09-11。开源免费,需自行部署。
它主要面向的使用场景是:为空间视觉语言模型构建训练数据集。同类可对比的替代方案包括 LLaVA、ShareGPT4V。

把图片视频自动变成带空间推理的VQA训练数据
VQASynth 是一个面向多模态数据集构建的开源工具,核心目标是把普通图像或视频转化为带有空间推理能力的视觉问答(VQA)训练数据。它通过场景重建与空间关系抽取,自动生成关于物体位置、相对距离、遮挡关系等空间语义的问答对,解决当前多模态大模型在空间理解任务上缺乏高质量标注数据的问题。项目以 Python 实现,提供可组合的数据生成流水线,支持接入视觉模型与语言模型协同工作,输出可直接用于训练 SpatialVLM 等空间视觉语言模型的数据集。适合需要自建多模态训练数据的研究者和工程团队,减少人工标注成本,同时提升数据在空间推理维度上的覆盖度。
LLaVA、ShareGPT4V
VQASynth 是数据集领域的开源项目,由 remyxai 开发,2024 年首次发布。
它收录于数据集分类,该分类目前共有 278 个项目,GitHub 星标数为 590。
项目目前处于活跃维护状态,最近一次代码更新于 2026-09-11。开源免费,需自行部署。
它主要面向的使用场景是:为空间视觉语言模型构建训练数据集。同类可对比的替代方案包括 LLaVA、ShareGPT4V。
上一篇:ml-stuttering-events-dataset
下一篇:malecns
X-AnyLabeling
开源
一站式AI辅助标注,图像视频文本通吃,导出格式随心配
X-AnyLabeling: A lightweight, efficient, and unified cross-platform desktop applicat···
aisheets
开源
像用表格一样批量调 AI,不写代码就能造和改数据集
Build, enrich, and transform datasets using AI models with no code
distilabel
开源
基于论文的合成数据流水线,快速生成高质量 AI 反馈数据。
Distilabel is a framework for synthetic data and AI feedback for engineers who need ···
DataGen
开源
用大模型一键生成定制化训练数据,告别数据荒
[ICLR'25] DataGen: Unified Synthetic Dataset Generation via Large Language Models