parsel

PHP 里直接解析 PDF 和图片文字,不用另起服务

parsel 是一个用 PHP 编写的开源文档解析库,目标是让 PHP 开发者无需依赖外部服务就能从 PDF、图片等文档中提取文本内容。它解决的核心问题是:PHP 生态中长期缺少轻量、易用的文档解析方案,传统做法要么调用命令行工具(如 pdftotext),要么依赖 Python/Java 服务,集成成本高。parsel 提供统一的 PHP API,支持 PDF 文本提取和基于 OCR 的图片文字识别,输出结构化文本,便于后续做搜索、索引或内容分析。项目强调快速、开箱即用,适合已有 PHP 技术栈的团队直接引入,避免为文档解析单独维护一套异构服务。

开源 free 办公效率
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 363
维护状态 较活跃
是否开源 是
定价模式 free

项目数据

分类办公效率
开发团队shipfastlabs
所属国家
官网地址
定价模式free
价格说明开源免费
访问状态
是否开源是
开源协议MIT
主要语言PHP
技术栈/模型docs,ocr,pdf,text-extarction
GitHub 星标★ 363
30天Star增速
HF 下载量
上线时间2026-05-29 00:00:00
最近更新2026-09-29 00:00:00
维护状态较活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-30
浏览次数0

使用教程

核心亮点

  • 纯 PHP 生态集成,无需额外部署 Python 或 Java 服务
  • 同时覆盖 PDF 文本提取和 OCR 图片识别两类常见需求
  • API 设计简洁,上手成本低,适合快速嵌入现有 PHP 项目

不足之处

  • 项目星标仅 363,属于早期阶段,社区和文档成熟度有限
  • OCR 识别质量依赖底层引擎,复杂版式或扫描件效果待验证

适用场景

  • PHP 后台系统批量导入 PDF 合同并提取关键字段
  • 内容管理系统中对上传的图片资料做文字检索
  • 发票或票据扫描件的文本抽取与归档处理

替代项目

smalot/pdfparser、spatie/pdf-to-text

项目介绍

parsel 是办公效率领域的开源项目,由 shipfastlabs 开发,是 2026 年新上线的项目。

它收录于办公效率分类,该分类目前共有 157 个项目,GitHub 星标数为 363。

项目保持着较活跃的维护节奏,最近一次代码更新于 2026-09-29。开源免费。

它主要面向的使用场景是:PHP后台系统批量导入PDF合同并提取关键字段。同类可对比的替代方案包括 smalot/pdfparser、spatie/pdf-to-text。

上一篇:ScreenMemo

下一篇:jt-doc-tools

同类项目推荐

sunshine-control-panel 开源

一站式管理游戏库、监控内存,AI 助手加持,让大屏启动更高效。

Sunshine Foundation 大屏桌面管理器 | Tauri + Vue 3,游戏库管理、米塔AI助手、内存监控···

★ 444 2026-08-09
Stirling PDF 开源

本地部署 PDF 工具箱

#1 PDF Application on GitHub that lets you edit PDFs on any device anywhere

★ 93264 2026-08-19
obsidian-md2wechat 开源

一键将 Obsidian 笔记排版成公众号文章,告别手动调格式

Obsidian → WeChat | Obsidian 插件一键排版发布到微信公众号,键排版发布到微信公众号:···

★ 318 2026-08-09
pdf2md 开源

浏览器里直接把 PDF 变成 Markdown,不用上传,隐私安全。

Browser based tool to convert PDFs to Markdown

★ 381 2026-08-09