
LT2MD
把 PDF 里的图表变成可读文字,段落带页码
LT2MD 是一个面向 AI Agent 的 PDF 转 Markdown 技能,专门解决传统转换工具把流程图、示意图和图表变成空链接或丢失内容的问题。它会把这些视觉元素转换成紧跟在图注旁边的文字描述,让 Markdown 文档保持完整可读。核心能力包括:对照原始 PDF 检查上一轮转换结果,自动修正误读或遗漏的部分;对长 PDF 采用小批次保存运行,并附独立的复核流程;每个段落都标注来源页码,方便溯源和引用。项目用 Python 编写,适合需要把扫描件或复杂排版 PDF 接入 RAG 流程、知识库构建或文档归档的场景。相比普通 PDF 解析器,它更强调可复用性和内容完整性,而不是只做一次性的文本抽取。
开源
free
办公效率
GitHub 星标
★ 110
维护状态
较活跃
是否开源
是
定价模式
free
项目数据
分类办公效率
开发团队libnyx
所属国家
定价模式free
价格说明开源免费使用
访问状态
是否开源是
开源协议AGPL-3.0
主要语言Python
技术栈/模型agent-skills,ai-agents,codex,codex-skill,document-conversion,llm,markdown,ocr,pdf,pdf-to-markdown,rag,scanned-documents,vlm
GitHub 星标★ 110
30天Star增速
HF 下载量
上线时间2026-08-14 00:00:00
最近更新2026-09-15 00:00:00
维护状态较活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-12
浏览次数1
使用教程
核心亮点
- 将流程图/图表转为图注旁的描述文字,避免空链接
- 带独立复核流程,能对照原 PDF 修正误读和遗漏
- 长文档分批保存运行,每段标注页码便于溯源
不足之处
- 项目处于早期,星标仅 114,生态和案例积累有限
- 依赖 AI Agent 环境运行,普通用户上手门槛较高
适用场景
- 把扫描版技术手册转成带图表描述的 Markdown 知识库
- 为 RAG 流程准备保留图表语义的 PDF 文档
- 将含大量流程图的论文或报告归档为可检索文本
替代项目
MinerU、marker、Docling
项目介绍
上一篇:office_oxide
下一篇:docwire
同类项目推荐
sunshine-control-panel
开源
一站式管理游戏库、监控内存,AI 助手加持,让大屏启动更高效。
Sunshine Foundation 大屏桌面管理器 | Tauri + Vue 3,游戏库管理、米塔AI助手、内存监控···
Stirling PDF
开源
本地部署 PDF 工具箱
#1 PDF Application on GitHub that lets you edit PDFs on any device anywhere
obsidian-md2wechat
开源
一键将 Obsidian 笔记排版成公众号文章,告别手动调格式
Obsidian → WeChat | Obsidian 插件一键排版发布到微信公众号,键排版发布到微信公众号:···
pdf2md
开源
浏览器里直接把 PDF 变成 Markdown,不用上传,隐私安全。
Browser based tool to convert PDFs to Markdown