bible 是数据集领域的开源项目,由 thiagobodruk 开发,2015 年首次发布。
它收录于数据集分类,该分类目前共有 281 个项目,GitHub 星标数为 741。
项目目前处于活跃维护状态,最近一次代码更新于 2026-09-25。开源免费数据集,无付费信息。
它主要面向的使用场景是:开发圣经阅读器或经文搜索App。同类可对比的替代方案包括 sword、openbible、bible-api。

90版35语圣经文本,JSON/XML 直接拿去用
bible 是一个开源的多语言圣经文本数据集,以 JSON 和 XML 两种结构化格式提供,覆盖 35 种语言的 90 个圣经版本。它解决的是开发者、研究者和内容创作者在需要圣经文本时,往往要面对格式混乱、编码不一、多语言版本分散、版权信息不清等麻烦。项目把各版本经文统一整理成可直接解析的数据,方便程序读取。核心能力包括:按书卷、章节、节号组织经文,支持逐节检索和全文搜索;多语言版本可并行对照,适合做翻译比较和跨语言研究;JSON 适合应用和 API 消费,XML 适合文档处理和出版流程;数据可直接用于 NLP 训练、语料分析、AI 问答和宗教类应用开发。对于想快速搭建圣经阅读器、经文搜索工具或构建多语言宗教语料库的团队,这是一个省去大量清洗工作的现成数据源。
sword、openbible、bible-api
bible 是数据集领域的开源项目,由 thiagobodruk 开发,2015 年首次发布。
它收录于数据集分类,该分类目前共有 281 个项目,GitHub 星标数为 741。
项目目前处于活跃维护状态,最近一次代码更新于 2026-09-25。开源免费数据集,无付费信息。
它主要面向的使用场景是:开发圣经阅读器或经文搜索App。同类可对比的替代方案包括 sword、openbible、bible-api。
上一篇:simulate
下一篇:chess-openings
X-AnyLabeling
开源
一站式AI辅助标注,图像视频文本通吃,导出格式随心配
X-AnyLabeling: A lightweight, efficient, and unified cross-platform desktop applicat···
aisheets
开源
像用表格一样批量调 AI,不写代码就能造和改数据集
Build, enrich, and transform datasets using AI models with no code
distilabel
开源
基于论文的合成数据流水线,快速生成高质量 AI 反馈数据。
Distilabel is a framework for synthetic data and AI feedback for engineers who need ···
DataGen
开源
用大模型一键生成定制化训练数据,告别数据荒
[ICLR'25] DataGen: Unified Synthetic Dataset Generation via Large Language Models