natural-language-processing
本站收录 205 个带「natural-language-processing」标签的 AI 开源项目(按 GitHub 星标从高到低,此处展示前 50 个)
transformersHugging Face 出品的模型定义框架,支持文本、视觉、音频与多模态模型,覆盖推理与训练全流程,是当前研究和生产中最主流的开源模型生态基石。★ 166,817
LLMs-from-scratch手把手教你用 PyTorch 从零实现一个 ChatGPT 级别的 LLM,逐行讲解代码与原理,是深入理解 Transformer 架构与大模型训练的最佳学习路★ 105,758
Made-With-ML一套面向生产级机器学习应用的完整学习课程,手把手教你如何开发、部署并持续迭代 ML 应用。内容覆盖从实验到上线的全流程实践,配有代码示例,适合希望系统掌握工程化★ 49,652
Resume-MatcherResume-Matcher 是一个本地优先的 AI 简历工具,核心目标是帮求职者把简历改到能通过 ATS(申请人跟踪系统)筛选,同时生成匹配岗位的求职信和 P★ 28,533
CV这是一份已完结的深度学习综合学习笔记,整合了多个知名课程的精髓,包括土堆的Pytorch教程、李沐的《动手学深度学习》、吴恩达的《深度学习》以及大飞的《大模型A★ 23,851
datasetsdatasets 是 Hugging Face 推出的开源数据集库,旨在成为 AI 模型就绪数据集的中心枢纽。它解决了机器学习从业者在数据获取、处理和加载过程中★ 22,016
QwenQwen(通义千问)是阿里巴巴云推出的开源大语言模型系列,包含对话模型和预训练模型。该项目提供了从0.5B到72B多种规模的模型权重,支持中英文及多语言,覆盖聊★ 21,881
rasaRasa 是一个开源的对话式 AI 框架,用于构建文本和语音驱动的聊天机器人与语音助手。它拆分为两个核心模块:Rasa NLU 负责意图识别和实体抽取,Rasa★ 21,331
DocsGPTDocsGPT 是一个面向企业的私有 AI 平台,专注于智能文档问答与知识检索。它解决了企业内部文档分散、查找困难、信息利用率低的问题,通过自然语言交互,让用户★ 18,295
camelCAMEL 是一个多智能体框架,旨在通过角色扮演和任务导向的对话,让多个 AI 智能体协同解决复杂问题。它解决了单智能体在复杂任务中能力受限的问题,通过定义不同★ 17,797
unstructuredUnstructured 是一个开源的 ETL 工具,专注于将复杂文档(如 PDF、Word、PPT、图片等)转换为干净、结构化的数据,以便直接用于大语言模型(★ 15,519
deep-learning-drizzle这是一个深度学习相关学习资源的精选合集,汇集了全球顶尖大学和机构的免费视频讲座,覆盖深度学习、强化学习、机器学习、计算机视觉和自然语言处理等核心领域。项目以分类★ 12,956
MOSSMOSS 是复旦大学自然语言处理实验室推出的开源对话语言模型,旨在复现 ChatGPT 的核心能力。它解决了传统对话模型缺乏工具使用和事实知识更新的问题,通过将★ 12,260
LLMSurveyLLMSurvey 是《A Survey of Large Language Models》论文的官方 GitHub 页面,旨在系统梳理大语言模型领域的发展脉络★ 12,224
ludwigLudwig 是一个基于 Python 的低代码机器学习框架,旨在让开发者无需编写大量底层代码即可构建、训练和部署定制化的大语言模型、神经网络及其他 AI 模型★ 11,771
openvinoOpenVINO 是英特尔开源的 AI 推理优化与部署工具包,旨在帮助开发者将训练好的深度学习模型(如 PyTorch、TensorFlow、ONNX 等格式)★ 10,935
autogluonAutoGluon 是一个自动化机器学习(AutoML)库,旨在用三行代码实现快速且准确的模型训练。它解决了传统机器学习中模型选择、超参数调优和特征工程耗时费力★ 10,754
stanford-tensorflow-tutorials这是一个斯坦福大学课程《TensorFlow for Deep Learning Research》的配套代码仓库,由课程讲师Chinmay Halbe维护。它★ 10,373
LLMsPracticalGuideLLMsPracticalGuide 是一个精心策划的实用指南资源列表,专注于大语言模型(LLMs)的实践应用。它汇集了 LLMs 的树状结构、示例和论文,旨在★ 10,211
nlp.jsnlp.js 是一个用 JavaScript 编写的自然语言处理库,专为构建聊天机器人而设计。它解决了开发者在创建对话式 AI 时面临的常见痛点,如意图识别、实★ 6,583
courses这是一个精选的AI学习资源集合,收录了关于人工智能、机器学习、深度学习、计算机视觉、自然语言处理、多模态、生成模型和MLOps等领域的课程与资料链接。项目以Ma★ 6,487
flash-linear-attentionflash-linear-attention 是一个专注于新兴模型架构高效实现的 Python 库,主要针对线性注意力机制(如 Mamba、RWKV、RetNe★ 5,802
oasisOASIS 是一个开源的大规模智能体社会模拟框架,支持在单台普通消费级 GPU 上运行多达一百万智能体的社交互动仿真。它解决了现有社交模拟工具在规模、速度和成本★ 5,209
argillaArgilla 是一个面向 AI 工程师和领域专家的协作工具,专注于构建高质量数据集。它解决了 LLM 项目中数据标注、反馈收集和数据集管理的痛点,提供直观的 ★ 5,128
LLM-RL-VisualizedLLM-RL-Visualized 是一个专注于大语言模型(LLM)和强化学习(RL)算法可视化的开源项目,由《大模型算法》作者倾力打造。项目提供了100多张原★ 4,922
AIGC-Interview-Book《三年面试五年模拟》是一份面向AIGC、LLM大模型、AI Agent算法工程师的面试准备资料集,由社区维护并持续更新。它系统整理了AI行业面试笔试中的核心知识★ 4,854
LLMBook-zh.github.io《大语言模型》是一本由中国人民大学赵鑫教授团队编写的中文开源教材,旨在系统性地介绍大语言模型的技术原理、架构设计与应用实践。全书覆盖从基础概念到前沿进展的完整知★ 4,584
spark-nlpspark-nlp 是一个基于 Apache Spark 和 Spark ML 构建的自然语言处理库,提供生产级、可扩展的 NLP 解决方案。它解决了在大数据环★ 4,158
Baichuan2Baichuan2 是百川智能推出的系列大语言模型,包括基座模型和对话模型,覆盖 7B、13B 等参数规模。它旨在提供高质量的中英文双语能力,解决通用对话、内容★ 4,084
GLiNERGLiNER是一个通用且轻量的命名实体识别(NER)模型,旨在解决传统NER模型只能识别预定义实体类型、无法灵活适配新场景的问题。它允许用户通过自然语言描述任意★ 3,966
JioNLPJioNLP 是一个面向中文 NLP 的预处理与解析工具包,旨在为自然语言处理任务提供准确、高效、易用的基础能力。它解决了中文文本处理中常见的痛点,如分词、词性★ 3,871
oliviaOlivia 是一个用 Go 编写的开源个人助理,基于人工神经网络实现自然语言对话。它旨在成为用户的“新好朋友”,通过本地运行的方式解决隐私和定制化问题。核心能★ 3,717
AI-Engineer-HeadquartersAI-Engineer-Headquarters 是一个面向 AI 工程师的知识库与工具集,以 Jupyter Notebook 形式组织,汇集了构建机器学习模★ 3,689
how-to-train-your-gpt这是一个从零开始构建现代大语言模型(LLM)的教学项目,以Jupyter Notebook形式呈现,每一行代码都有详细注释,并用通俗易懂的方式解释,适合初学者和★ 3,569
ai-system-design-guide这是一份面向工程师的AI系统设计指南,专注于帮助开发者构建生产级AI系统和评估体系。项目系统性地整理了从需求分析、架构设计到模型评估、部署运维的完整知识框架,涵★ 3,430
mlops-course这是一个面向生产级机器学习应用的教学课程仓库,旨在帮助开发者掌握从设计、开发、部署到迭代的完整MLOps流程。课程内容涵盖数据版本管理、模型实验追踪、CI/CD★ 3,405
catalystCatalyst 是一个面向深度学习研究与开发的 Python 框架,旨在加速从实验设计到模型部署的全流程。它解决了深度学习项目中代码重复、实验管理混乱、复现困★ 3,387
EvoAgentXEvoAgentX 是一个构建自我进化 AI 智能体生态系统的开源框架。它解决的是如何让多个 AI 智能体在动态环境中协同工作、自动适应和持续进化的问题。核心能★ 3,359
EvoAgentXEvoAgentX 是一个用 Python 构建的 AI 智能体自进化生态框架,目标不是再写一个多智能体编排库,而是让智能体系统具备持续自我改进的能力。它把智能★ 3,359
siesie 是一个开源的推理服务器和生产级集群,专为智能体(agent)所需的各类模型提供统一部署和调度。它解决了多模型、多副本在生产环境中难以统一管理的问题,提供★ 3,337
OSWorldOSWorld 是一个用于评估多模态 AI 智能体在真实计算机环境中执行开放式任务能力的基准测试平台,发表于 NeurIPS 2024。它解决了现有基准测试环境★ 3,165
LLMAgentPapersLLMAgentPapers 是一个精心整理的论文清单,聚焦于大语言模型(LLM)智能体领域。它系统性地收录了该方向的重要论文,涵盖智能体架构、规划、记忆、工具★ 3,122
EasyEditEasyEdit 是一个面向大语言模型(LLM)的知识编辑框架,由 ACL 2024 论文提出,旨在高效、精准地修改模型内部已学到的知识,而无需重新训练或微调。★ 2,927
EasyLMEasyLM 是一个基于 JAX/Flax 构建的大语言模型(LLM)一站式解决方案,旨在简化 LLM 的预训练、微调、评估和部署流程。它解决了 LLM 开发中★ 2,516
texartexar 是一个基于 TensorFlow 的工具包,专注于机器学习、自然语言处理和文本生成任务,属于 CASL 项目的一部分。它旨在简化 NLP 模型的开发★ 2,389
RAGHubRAGHub 是一个由社区驱动的检索增强生成(RAG)框架、项目和资源集合。它旨在解决 RAG 生态系统中信息分散、难以快速找到合适工具和最佳实践的问题。该项目★ 2,006
LLMCompilerLLMCompiler 是一个面向大语言模型(LLM)的函数调用并行化框架,源自 ICML 2024 论文。它借鉴传统编译器思想,将复杂的多步骤任务分解为依赖图★ 1,890
extractousextractous 是一个用 Rust 编写的高性能非结构化数据提取库,旨在解决从 PDF、Word、HTML、图片等各类文件中快速提取文本和元数据的问题。它★ 1,780
curatorcurator 是一个专注于合成数据策展的开源工具,主要服务于大语言模型的后训练阶段和结构化数据提取。它解决了高质量训练数据难以获取、合成数据质量参差不齐的问题★ 1,736
korkor 是一个用于简化大语言模型(LLM)输出结构化的 Python 库。它解决的核心问题是:LLM 返回的是自然语言,难以直接用于程序处理。通过声明式地定义输★ 1,685