bible

90版35语圣经文本,JSON/XML 直接拿去用

bible 是一个开源的多语言圣经文本数据集,以 JSON 和 XML 两种结构化格式提供,覆盖 35 种语言的 90 个圣经版本。它解决的是开发者、研究者和内容创作者在需要圣经文本时,往往要面对格式混乱、编码不一、多语言版本分散、版权信息不清等麻烦。项目把各版本经文统一整理成可直接解析的数据,方便程序读取。核心能力包括:按书卷、章节、节号组织经文,支持逐节检索和全文搜索;多语言版本可并行对照,适合做翻译比较和跨语言研究;JSON 适合应用和 API 消费,XML 适合文档处理和出版流程;数据可直接用于 NLP 训练、语料分析、AI 问答和宗教类应用开发。对于想快速搭建圣经阅读器、经文搜索工具或构建多语言宗教语料库的团队,这是一个省去大量清洗工作的现成数据源。

开源 free 数据集
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 741
维护状态 活跃
是否开源 是
定价模式 free

项目数据

分类数据集
开发团队thiagobodruk
所属国家
官网地址
定价模式free
价格说明开源免费数据集,无付费信息
访问状态
是否开源是
开源协议MIT
主要语言
技术栈/模型bible,bible-api,bible-json,bible-verses,bible-xml,christian,dataset,i18n,json,multilingual,nlp,open-data,religious-texts,scripture,xml
GitHub 星标★ 741
30天Star增速
HF 下载量
上线时间2015-11-13 00:00:00
最近更新2026-09-25 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-28
浏览次数0

使用教程

核心亮点

  • 覆盖 35 种语言、90 个版本,多语言对照场景开箱即用
  • 同时提供 JSON 和 XML,兼顾应用开发与文档处理两类需求
  • 按书卷章节节号结构化,便于逐节检索和全文搜索

不足之处

  • 项目语言标记为未知,技术栈和构建方式不够透明
  • 作为数据集,缺少版本更新频率和校验机制的说明

适用场景

  • 开发圣经阅读器或经文搜索 App
  • 构建多语言宗教文本 NLP 语料库
  • 做跨语言圣经翻译对照研究

替代项目

sword、openbible、bible-api

项目介绍

bible 是数据集领域的开源项目,由 thiagobodruk 开发,2015 年首次发布。

它收录于数据集分类,该分类目前共有 281 个项目,GitHub 星标数为 741。

项目目前处于活跃维护状态,最近一次代码更新于 2026-09-25。开源免费数据集,无付费信息。

它主要面向的使用场景是:开发圣经阅读器或经文搜索App。同类可对比的替代方案包括 sword、openbible、bible-api。

上一篇:simulate

下一篇:chess-openings

同类项目推荐

X-AnyLabeling 开源

一站式AI辅助标注,图像视频文本通吃,导出格式随心配

X-AnyLabeling: A lightweight, efficient, and unified cross-platform desktop applicat···

★ 10546 2026-08-10
aisheets 开源

像用表格一样批量调 AI,不写代码就能造和改数据集

Build, enrich, and transform datasets using AI models with no code

★ 1647 2026-09-20
distilabel 开源

基于论文的合成数据流水线,快速生成高质量 AI 反馈数据。

Distilabel is a framework for synthetic data and AI feedback for engineers who need ···

★ 3400 2026-08-10
DataGen 开源

用大模型一键生成定制化训练数据,告别数据荒

[ICLR'25] DataGen: Unified Synthetic Dataset Generation via Large Language Models

★ 69 2026-08-09