information-extraction

本站收录 12 个带「information-extraction」标签的 AI 开源项目

PaddleNLPPaddleNLP 是百度飞桨生态下的自然语言处理库,定位为易用且强大的大模型与小模型库,内置丰富的模型动物园。它解决从文本分类、序列标注到大规模预训练模型微调★ 12,981Hyper-ExtractHyper-Extract 是一个基于大语言模型的知识抽取工具,能将非结构化文本自动转换为结构化知识图谱。它支持普通图、超图和时空抽取,用户只需一条命令即可完成★ 4,045snips-nluSnips NLU 是一个用 Python 编写的自然语言理解库,专注于从文本中提取结构化意图和实体信息。它解决的是对话式 AI 中“理解用户意图”的核心问题,★ 3,975GLiNERGLiNER是一个通用且轻量的命名实体识别(NER)模型,旨在解决传统NER模型只能识别预定义实体类型、无法灵活适配新场景的问题。它允许用户通过自然语言描述任意★ 3,966korkor 是一个用于简化大语言模型(LLM)输出结构化的 Python 库。它解决的核心问题是:LLM 返回的是自然语言,难以直接用于程序处理。通过声明式地定义输★ 1,685Awesome-LLM4IE-PapersAwesome-LLM4IE-Papers 是一个精选论文列表,专注于大语言模型(LLM)在生成式信息抽取(IE)领域的应用。该项目系统整理了利用LLM进行实体★ 1,064ontogptontogpt 是一个基于大型语言模型(LLM)的本体论信息抽取工具集,核心组件是 SPIRES(Structured Prompt Interrogation★ 1,037KG-MM-SurveyKG-MM-Survey 是一份关于知识图谱与多模态学习交叉领域的系统性综述列表。它整理了知识图谱如何与图像、文本等多模态数据结合的研究工作,覆盖跨模态检索、实★ 507AutoKGAutoKG 是一个基于大型语言模型(LLMs)的知识图谱构建与推理的开源框架,源自 WWWJ 2024 论文。它旨在解决传统知识图谱构建依赖人工标注、成本高且★ 473IEPileIEPile是一个大规模信息抽取语料库,由浙江大学等机构在ACL 2024发布。它收集并清洗了来自多个公开数据源的约2000万条信息抽取样本,覆盖实体识别、关系★ 213OneKEOneKE 是一个基于大语言模型的知识抽取系统,以 Docker 容器化方式部署,通过模式(Schema)引导的智能体(Agent)机制,从非结构化文本中自动抽★ 195langstructlangstruct 是一个基于 Python 的轻量级工具库,旨在利用大语言模型从任意非结构化内容中提取结构化数据。它解决了传统解析方法对格式依赖强、难以适应★ 130