document-ai

本站收录 19 个带「document-ai」标签的 AI 开源项目

unilmUniLM是微软开源的大规模自监督预训练模型系列,旨在统一处理自然语言理解与生成任务。它基于Transformer架构,通过掩码语言建模、序列到序列建模等预训练★ 22,226unstractunstract 是一个基于大语言模型(LLM)的智能数据提取平台,专门用于从非结构化文档(如 PDF、图片、扫描件)中自动抽取结构化数据,并以 JSON 格式★ 7,266YuxiYuxi 是一个面向多租户场景的 Agent Harness 平台,核心定位是将知识库与知识图谱管理深度整合,为构建智能代理提供一体化基础设施。它基于 Lang★ 7,237deepdoctectiondeepdoctection 是一个面向文档 AI 的 Python 工具库,旨在帮助开发者从 PDF、扫描件等非结构化文档中提取结构化信息。它解决了文档解析中★ 3,260OpenBidKit_Yibiao开箱即用的 AI 标书编写工具,覆盖投标全流程:AI 生成标书内容、投标工具箱、知识库管理、标书查重与废标项检查一应俱全。完全开源免费,帮助投标人员快速高效地完★ 3,077thepipethepipe 是一个基于视觉语言模型(VLM)的文档数据清洗工具,专门解决从复杂文档(如扫描件、PDF、PPT、表格、手写笔记等)中提取干净结构化数据的问题。★ 1,529TurboOCRTurboOCR 是一个基于 C++ 实现的高性能 OCR 服务,专为追求极致吞吐量的场景设计。它集成了百度飞桨的 PP-OCRv6 模型,并利用 Tensor★ 1,098haiku.raghaiku.rag 是一个基于 LanceDB、Pydantic AI 和 Docling 构建的 agentic RAG(检索增强生成)框架,主打“有主见”(★ 615ParseBenchParseBench 是一个面向 AI Agent 的文档解析基准测试工具,旨在解决 LLM 应用中文档解析能力难以量化评估的问题。它提供了一套标准化的评测流程★ 592docling-Studiodocling-Studio 是一个基于 Docling 的可视化文档分析工作台,面向需要处理 PDF 等复杂文档的开发者与数据团队。它把文档解析流水线搬到浏览★ 262pawworkPawWork 是一款免费开源的桌面端 AI 智能体应用,支持 macOS 和 Windows,定位为 Codex App 和 Claude Cowork 的替★ 200exstructexstruct 是一个将 Excel 文件转换为结构化 JSON 的开源工具,专为 LLM/RAG 管道和 AI 智能体设计。它解决的核心问题是:Excel ★ 200aiworkdeckaiworkdeck 是一个面向法律与文档密集型工作流的 AI 原生 IDE 工作空间,定位为“律师的 VS Code”。它整合了文件管理、AI 智能体、插件系★ 150paddleocr-localpaddleocr-local 是一个本地优先的文档解析工作台,把 PDF、Office 等格式的文件转换成 Markdown,全程在本机完成,不上传云端。它集★ 132ReadingBankReadingBank 是一个面向阅读顺序检测任务的基准数据集,由文档 AI 研究者构建。它要解决的问题是:在 OCR 识别出页面文字后,机器往往不知道人类应该★ 119DocMeldDocMeld 是一个轻量级的文档到智能体就绪知识流水线工具,专为处理研究论文和书籍设计。它采用三阶段的 Bronze→Silver→Gold 架构,依次提取结★ 102hr-onboarding-agenthr-onboarding-agent 是一个面向飞书/Lark 的开源 AI 入职助手,目标是把 HR 入职流程从手工催办、表格搬运变成可配置的自动化工作流。★ 101rag-tenderrag-tender 是一个面向招投标场景的本地化 RAG 助手,旨在解决标书文件繁多、资质匹配耗时、合规风险难发现等问题。它通过检索增强生成(RAG)技术,对★ 93ai-assistant-demo这是一个基于PSPDFKit的AI文档助手演示项目,旨在展示如何通过自然语言命令与PDF文档进行交互。它解决了传统PDF操作繁琐、效率低下的问题,让用户可以用日★ 68