large-language-models
本站收录 1058 个带「large-language-models」标签的 AI 开源项目(按 GitHub 星标从高到低,此处展示前 50 个)
langflowLangflow 是一个基于 Python 的开源可视化 AI 工作流构建平台,通过拖拽组件的方式编排大模型、提示词、数据源和工具调用,帮助开发者快速搭建智能体★ 155,376
LLMs-from-scratch手把手教你用 PyTorch 从零实现一个 ChatGPT 级别的 LLM,逐行讲解代码与原理,是深入理解 Transformer 架构与大模型训练的最佳学习路★ 105,758
llm-coursellm-course 是一个面向大语言模型(LLM)学习者的开源课程仓库,提供从入门到进阶的完整学习路线图(roadmaps)和配套的 Colab 笔记本。它解★ 83,228
LlamaFactory统一的 LLM 高效微调框架,支持 100+ 主流模型(LLM 与 VLM),集成 LoRA 等前沿技术,被 ACL 2024 收录,是微调领域最流行的开源工具★ 75,189
gpt_academicgpt_academic 是一个为 GPT/GLM 等大语言模型提供实用化交互接口的开源项目,特别优化了论文阅读、润色和写作体验。它解决了学术研究中利用大模型效★ 71,393
Flowise以可视化方式构建 AI Agent 的开源平台。通过拖拽式界面编排 LLM、工具与数据流,无需深入代码即可快速设计、调试和部署智能体工作流,大幅降低 Agent★ 55,492
ai-agent-book《深入理解 AI Agent:设计原理与工程实践》是一本由李博杰撰写的开源技术书籍,旨在系统讲解 AI Agent 的设计原理与工程实践。该书解决了开发者从零构★ 51,740
rayRay 是一个面向 AI 计算的分布式引擎,由核心分布式运行时和一组 AI 库组成,用于加速机器学习工作负载。它解决了大规模分布式训练、调参、推理和服务部署中的★ 43,949
LightRAGLightRAG 是一个面向检索增强生成(RAG)场景的轻量级开源框架,旨在解决传统 RAG 系统在知识图谱构建和检索效率上的痛点。它通过将知识图谱与向量检索相★ 39,922
langextractlangextract 是一个 Python 库,旨在利用大型语言模型从非结构化文本中提取结构化信息,并具备精确的源定位和交互式可视化能力。它解决了传统文本提取★ 38,918
langfuseLangfuse 是一个开源的 AI 工程平台,专注于 LLM 应用的可观测性、评估与提示词管理。它解决了 LLM 应用开发中调试困难、质量评估主观、提示词迭代★ 35,205
agentscope阿里通义实验室开源的智能体开发框架,核心主张是构建并运行「看得见、看得懂、信得过」的智能体。提供统一的多智能体编排、分布式调度与可视化调试能力,支持大模型服务接★ 32,570
stormSTORM是一个基于大语言模型的知识整理系统,能够针对用户给定的主题进行自主研究,并生成带有引用的完整长篇报告。它通过多智能体协作模拟人类写作流程,包括资料收集★ 31,536
awesome-generative-ai-guide这是一个聚合生成式AI研究资源的一站式仓库,主要面向研究人员、工程师和学习者。项目整理了最新的生成式AI论文、研究动态、面试题、实用笔记和代码示例,帮助用户快速★ 29,638
Hands-On-Large-Language-Models这是 O'Reilly 出版的《Hands-On Large Language Models》一书的官方代码仓库,提供配套的 Jupyter Notebook ★ 29,400
haystackHaystack 是一个开源的 AI 编排框架,用于构建生产级、上下文工程化的 LLM 应用。它通过模块化管道和代理工作流,让开发者对检索、路由、记忆和生成等环★ 26,634
QwenQwen(通义千问)是阿里巴巴云推出的开源大语言模型系列,包含对话模型和预训练模型。该项目提供了从0.5B到72B多种规模的模型权重,支持中英文及多语言,覆盖聊★ 21,881
FinGPTFinGPT 是一个开源的金融大语言模型项目,旨在为金融领域提供可定制、可访问的 LLM 解决方案。它解决了金融文本处理中数据隐私、高成本和领域适配难题,通过数★ 21,303
machine-learning-for-trading这是一个与《Machine Learning for Trading》第三版配套的开源代码仓库,旨在帮助读者和开发者系统学习如何将机器学习技术应用于金融交易。项★ 21,121
ml-engineering这是一本面向机器学习工程师的开放书籍,系统梳理了大模型训练与推理全流程的工程实践。它解决的核心问题是:当模型规模从百万级跃升到百亿级时,硬件选型、分布式策略、性★ 19,062
Chinese-LLaMA-AlpacaChinese-LLaMA-Alpaca 是一个专注于中文大语言模型的开源项目,旨在将 Meta 的 LLaMA 和 Stanford 的 Alpaca 模型进★ 18,939
Awesome-Multimodal-Large-Language-Models这是一个持续更新的多模态大语言模型(MLLM)资源清单,汇总了领域内最新进展,包括论文、模型、数据集和工具。项目按模型架构、任务类型和应用场景分类整理,覆盖从视★ 18,040
Megatron-LMMegatron-LM 是 NVIDIA 主导的深度学习研究项目,专注于大规模 Transformer 模型的训练。它解决了在大规模分布式环境下训练千亿乃至万亿★ 18,031
camelCAMEL 是一个多智能体框架,旨在通过角色扮演和任务导向的对话,让多个 AI 智能体协同解决复杂问题。它解决了单智能体在复杂任务中能力受限的问题,通过定义不同★ 17,797
generative-aigenerative-ai 是 Google Cloud 官方维护的开源示例库,专注于生成式 AI 在 Google Cloud 上的落地实践。项目提供大量 J★ 17,775
PentestGPTPentestGPT 是一个基于大语言模型的自动化渗透测试智能体框架。它解决传统渗透测试高度依赖专家经验、流程繁琐且自动化程度低的问题,通过将 LLM 的推理能★ 15,647
ChatGLM2-6BChatGLM2-6B 是智谱AI推出的第二代开源双语对话模型,基于通用语言模型(GLM)架构,拥有62亿参数,支持中英文双语。它解决了大模型部署门槛高、资源消★ 15,508
litgptLitGPT 是一个基于 PyTorch 的高性能大语言模型(LLM)训练与部署框架,由 Lightning AI 团队开发。它内置了 20 多种主流 LLM ★ 13,687
txtaitxtai 是一个全栈 AI 框架,旨在将语义搜索、大语言模型编排和语言模型工作流整合到一个统一的工具中。它解决了从非结构化文本中高效检索信息、构建 RAG 应★ 12,988
open-llmsopen-llms 是一个精选的开源大语言模型列表,专门收录可商用(即宽松许可证)的模型。它解决的是开发者在选择开源 LLM 时面临的许可证合规与模型信息分散问★ 12,887
awesome-generative-ai这是一个精心整理的生成式人工智能项目和服务的精选列表,旨在帮助开发者、研究者和爱好者快速发现和了解当前最前沿的生成式AI工具与资源。它解决了信息过载和资源分散的★ 12,696
PocketFlow-Tutorial-Codebase-KnowledgePocketFlow-Tutorial-Codebase-Knowledge 是一个将代码库转化为教程的开源项目,旨在解决开发者学习大型代码库时面临的入门门槛高★ 12,682
HRMHRM(Hierarchical Reasoning Model)是一个开源的分层推理模型,旨在提升大语言模型在复杂推理任务中的表现。它通过构建多层次的推理结构★ 12,645
MOSSMOSS 是复旦大学自然语言处理实验室推出的开源对话语言模型,旨在复现 ChatGPT 的核心能力。它解决了传统对话模型缺乏工具使用和事实知识更新的问题,通过将★ 12,260
LLMSurveyLLMSurvey 是《A Survey of Large Language Models》论文的官方 GitHub 页面,旨在系统梳理大语言模型领域的发展脉络★ 12,224
train-llm-from-scratch这是一个从零开始训练大型语言模型(LLM)的完整教程与工具集,旨在帮助开发者理解并实践LLM训练的全流程。项目覆盖了从数据下载、预处理、分词器训练、模型架构设计★ 11,753
tensorzero开源的 LLMOps 平台,将 LLM 网关、可观测性、评估、优化与实验管理整合于一体。团队可以在统一界面中路由模型请求、追踪调用质量并持续调优提示词与模型组合★ 11,715
PocketFlow仅 100 行代码的极简 LLM 框架,践行「让 Agent 构建 Agent」的理念,轻量易懂,适合快速原型验证与教学。★ 11,207
llm-engineer-toolkitllm-engineer-toolkit 是一个精心整理的 LLM 工程师工具包清单,收录了 120+ 个按类别划分的 LLM 相关开源库和工具。它解决了 LL★ 10,875
petalsPetals 是一个去中心化的 LLM 推理与微调框架,采用 BitTorrent 风格的点对点网络,将大型语言模型(如 Llama、Falcon、BLOOM)★ 10,592
LLMsPracticalGuideLLMsPracticalGuide 是一个精心策划的实用指南资源列表,专注于大语言模型(LLMs)的实践应用。它汇集了 LLMs 的树状结构、示例和论文,旨在★ 10,211
OpenRLHFOpenRLHF 是一个基于 Ray 的强化学习框架,专为大规模语言模型(LLM)的智能体训练而设计。它解决了传统 RLHF(人类反馈强化学习)流程中训练效率低★ 10,053
PowerInferPowerInfer 是一个面向本地部署的高速大语言模型推理引擎,专注于在消费级硬件上实现接近服务器级的推理速度。它通过利用大语言模型推理中的高稀疏性(即神经元★ 9,815
anomaly-detection-resources这是一个异常检测领域的精选资源清单,汇集了书籍、论文、视频和工具箱,覆盖从经典统计方法到深度学习、大语言模型(LLM)和视觉语言模型(VLM)的最新进展。项目持★ 9,406
FlexLLMGenFlexLLMGen是一个专注于在单张GPU上高效运行大语言模型的开源推理框架,主要面向高吞吐量场景。它解决了单卡显存有限、难以部署大模型以及推理吞吐量低的问题★ 9,345
deeplake面向 AI Agent 的数据运行时,提供无服务器 PostgreSQL 与多模态数据湖,支持大规模数据的高效检索与训练。开发者可以像使用数据库一样管理图像、文★ 9,245
awesome-LLM-resources这是一个精选的LLM(大语言模型)资源合集,汇总了全球范围内关于多模态生成、Agent、辅助编程、AI审稿、数据处理、模型训练与推理、o1模型、MCP、小语言模★ 8,991
VARNeurIPS 2024 最佳论文奖的官方实现,提出视觉自回归建模(VAR),通过下一尺度预测生成图像,以超简单易用的方式达到超越扩散模型的最新效果,并揭示了视★ 8,733
optimateoptimate 是一个专注于优化 AI 模型性能的 Python 库集合,旨在帮助开发者和研究人员在不改变模型结构的前提下,通过量化、剪枝、蒸馏等压缩技术,显★ 8,328
LLM-Agent-Paper-List这是一个关于大语言模型智能体(LLM Agent)的论文清单,源自一篇发表在《中国科学:信息科学》封面上的86页综述论文《The Rise and Potent★ 8,221