language-model
本站收录 121 个带「language-model」标签的 AI 开源项目(按 GitHub 星标从高到低,此处展示前 50 个)
generative-ai-for-beginners这是微软出品的面向初学者的生成式 AI 课程,共 21 节课,涵盖生成式 AI 的基础概念、提示工程、大语言模型、RAG、AI Agent 以及相关应用开发。课★ 120,786
LLMs-from-scratch手把手教你用 PyTorch 从零实现一个 ChatGPT 级别的 LLM,逐行讲解代码与原理,是深入理解 Transformer 架构与大模型训练的最佳学习路★ 105,758
Prompt-Engineering-GuidePrompt-Engineering-Guide 是一个系统化的提示工程指南库,汇集了论文、教程、笔记本和资源,覆盖提示工程、上下文工程、RAG 和 AI Ag★ 78,724
gpt4free官方 gpt4free 仓库,汇集 Opus 4.6、GPT 5.3、Kimi 2.5、DeepSeek V3.2、Gemini 3 等众多强大语言模型,让你无★ 66,739
repomix强大的代码仓库打包工具,将整个代码库压缩为单个 AI 友好的文件,方便直接投喂给 Claude、ChatGPT、DeepSeek、Perplexity、Gemi★ 28,585
aiAI SDK 是 Vercel 推出的 TypeScript 工具库,专为构建 AI 应用和智能体而设计。它解决了开发者在接入大模型时面临的碎片化问题,提供了一★ 27,036
mlc-llmmlc-llm 是一个通用的 LLM 部署引擎,核心思路是用机器学习编译技术将大模型高效地部署到各种硬件后端上,包括消费级 GPU、手机、浏览器等。它解决的核心★ 23,198
web-llmweb-llm 是一个高性能的浏览器端大语言模型推理引擎,基于 WebGPU 和 TVM 技术,让 LLM 无需服务器即可直接在浏览器中运行。它解决了传统 LL★ 19,205
DocsGPTDocsGPT 是一个面向企业的私有 AI 平台,专注于智能文档问答与知识检索。它解决了企业内部文档分散、查找困难、信息利用率低的问题,通过自然语言交互,让用户★ 18,295
RWKV-LMRWKV-LM 是一个将循环神经网络(RNN)与 Transformer 优势结合的下一代语言模型架构,当前版本为 RWKV-7 Goose。它解决了传统 Tr★ 14,731
open_clipOpen_CLIP 是 CLIP 模型的开源实现,由 LAION 等社区维护,旨在复现并扩展 OpenAI 的 CLIP 模型。它解决了 CLIP 原始代码未开★ 14,174
speech-to-speechspeech-to-speech 是一个构建本地语音代理的开源项目,旨在利用开源模型实现端到端的语音交互。它解决了传统语音助手依赖云端服务、延迟高、隐私风险大等★ 13,350
txtaitxtai 是一个全栈 AI 框架,旨在将语义搜索、大语言模型编排和语言模型工作流整合到一个统一的工具中。它解决了从非结构化文本中高效检索信息、构建 RAG 应★ 12,988
speechbrainSpeechBrain 是一个基于 PyTorch 的开源语音工具包,旨在为语音识别、说话人识别、语音增强、语音分离、情感识别等多种语音任务提供统一、灵活且易用★ 11,848
ChatRWKVChatRWKV 是一个基于 RWKV 语言模型的开源对话助手,RWKV 是一种 100% 循环神经网络(RNN)架构,旨在以较低的计算成本实现类似 ChatG★ 9,497
LMFlowLMFlow 是一个面向大型基础模型的高可扩展微调与推理工具包,旨在让每个人都能轻松使用和定制大模型。它解决了大模型微调门槛高、资源消耗大、流程复杂的问题,提供★ 8,486
agentsagents 是一个面向数据驱动、自我进化的自主语言智能体的开源框架。它解决的核心问题是:如何让大语言模型智能体不仅依赖静态提示词,还能从数据中持续学习和改进。★ 5,963
zepZep 是一个面向 AI 代理和对话应用的开源记忆层(Memory Layer)服务。它解决的是当前 LLM 应用普遍缺乏长期、结构化记忆的问题,让 AI 代理★ 4,940
OpenAgentsOpenAgents 是一个面向真实场景的开源语言智能体平台,由 X-LANCE 团队开发,相关论文发表于 COLM 2024。它旨在解决大语言模型在现实世界中★ 4,861
LLMBook-zh.github.io《大语言模型》是一本由中国人民大学赵鑫教授团队编写的中文开源教材,旨在系统性地介绍大语言模型的技术原理、架构设计与应用实践。全书覆盖从基础概念到前沿进展的完整知★ 4,584
LMOpsLMOps是一个聚焦于大语言模型(LLM)和多模态大模型(MLLM)能力落地的通用技术项目。它解决的是从模型到实际应用之间的工程化鸿沟,提供一系列工具、方法和最★ 4,477
langroidLangroid 是一个面向大型语言模型(LLM)的多智能体编程框架,旨在让开发者通过简洁的 Python 代码编排多个智能体协作,完成复杂任务。它解决了直接调★ 4,108
how-to-train-your-gpt这是一个从零开始构建现代大语言模型(LLM)的教学项目,以Jupyter Notebook形式呈现,每一行代码都有详细注释,并用通俗易懂的方式解释,适合初学者和★ 3,569
OSWorldOSWorld 是一个用于评估多模态 AI 智能体在真实计算机环境中执行开放式任务能力的基准测试平台,发表于 NeurIPS 2024。它解决了现有基准测试环境★ 3,165
awesome-speech-recognition-speech-synthesis-papers这是一个收录语音识别与语音合成领域经典论文的精选列表,涵盖自动语音识别(ASR)、说话人验证、语音合成、文本转语音(TTS)、语言建模、歌声合成(SVS)和声音★ 3,132
CodeT5CodeT5 是一个专注于代码理解和生成的开源大语言模型系列,由 Salesforce Research 开发。它基于 T5 架构,通过在大量代码和自然语言文本★ 3,092
LinlyLinly 是一个专注于中文大语言模型的开源项目,提供从基础模型到对话模型的完整训练方案和数据集。它包含 Chinese-LLaMA 1&2、Chinese-F★ 3,037
InternLM-XComposerInternLM-XComposer 是上海人工智能实验室推出的多模态大模型系统,最新版本 2.5-OmniLive 专注于长时流式视频与音频的实时交互。它解决★ 2,928
lingvoLingvo 是 Google 开源的深度学习框架,专注于序列建模任务,尤其擅长语音识别、机器翻译和语言模型。它基于 TensorFlow 构建,提供了一套模块★ 2,864
Time-LLMTime-LLM 是一个面向时间序列预测的开源模型,其核心思路是“重编程”大型语言模型(LLM),将时间序列数据转化为文本原型,从而利用 LLM 强大的模式识别★ 2,701
xTuringxTuring 是一个面向个人和团队的开源大语言模型(LLM)个性化工具,旨在简化从数据预处理到模型微调的全流程。它解决了普通开发者难以快速上手 LLM 微调的★ 2,675
Awesome-LLM-KGAwesome-LLM-KG 是一个精选论文列表,系统梳理了大型语言模型(LLM)与知识图谱(KG)融合方向的研究成果。它解决了该领域论文分散、难以追踪的问题,★ 2,615
EasyLMEasyLM 是一个基于 JAX/Flax 构建的大语言模型(LLM)一站式解决方案,旨在简化 LLM 的预训练、微调、评估和部署流程。它解决了 LLM 开发中★ 2,516
mixtral-offloadingmixtral-offloading 是一个让 Mixtral-8x7B 大模型在消费级硬件(如 Colab 免费版或个人桌面)上运行的工具。它通过智能的层卸载★ 2,334
Awesome-LM-SSPAwesome-LM-SSP 是一个聚焦大模型安全、隐私与可信度的精选阅读清单,收录了相关论文、工具、数据集和攻击防御方法。它系统梳理了提示注入、越狱攻击、隐私★ 2,081
aiciAICI(Artificial Intelligence Controller Interface)是一个开源框架,它提出了一种全新的与大语言模型交互的方式:将★ 2,076
Awesome-Efficient-LLMAwesome-Efficient-LLM 是一个精选资源列表,专注于高效大语言模型(LLM)领域。它系统整理了模型压缩、推理加速、架构优化、量化、剪枝、知识蒸★ 2,043
MotionGPTMotionGPT 是一个将人体运动视为一种‘外语’的统一生成模型,发表于 NeurIPS 2023。它利用大型语言模型(LLM)的架构来处理运动序列,将动作数★ 1,974
perplexity-ai这是一个非官方的 Perplexity.ai API 封装工具,同时附带账号生成器和 Web 界面。它解决了开发者无法直接通过官方 API 访问 Perplex★ 1,913
raptorRAPTOR 是论文《Recursive Abstractive Processing for Tree-Organized Retrieval》的官方实现,提★ 1,763
ChatLM-mini-ChineseChatLM-mini-Chinese 是一个仅 0.2B 参数的中文对话小模型,旨在降低大语言模型的研究与开发门槛。它开源了从数据构建到模型优化的全流程代码,★ 1,736
swarkswark 是一个利用大语言模型(LLM)自动从代码生成架构图的开发工具。它解决了手动绘制架构图耗时且容易与代码脱节的问题,通过解析代码结构并调用 LLM 理解★ 1,698
MemoryOSMemoryOS 是一个为个性化 AI 智能体设计的记忆操作系统,源自 EMNLP 2025 Oral 论文。它解决的是 AI 智能体在长期交互中缺乏持久、结构★ 1,591
rwkv.cpprwkv.cpp 是一个专注于在 CPU 上高效运行 RWKV 语言模型的推理引擎,支持 INT4、INT5、INT8 和 FP16 等多种量化精度。它解决了 ★ 1,583
VibeThinkerVibeThinker是一个基于多样性驱动优化的小型语言模型项目,核心目标是在1.5B参数规模下实现接近大型模型的推理能力。它通过创新的训练策略,让小型模型在逻★ 1,579
OpenSeq2SeqOpenSeq2Seq 是 NVIDIA 开源的序列到序列学习工具包,专注于语音识别、文本转语音和自然语言处理任务。它解决了研究人员在搭建和实验 seq2seq★ 1,559
awesome-japanese-llm这是一个专门汇总日本语大语言模型(LLM)资源的精选清单项目,旨在解决日语NLP领域模型分散、信息难找的问题。它系统整理了各类支持日语的LLM,包括开源模型、商★ 1,433
gpu_poorgpu_poor 是一个用于估算任意大语言模型(LLM)在本地部署时所需 GPU 显存和推理速度(token/s)的命令行工具。它通过解析模型的参数量、量化方式★ 1,400
KnowLMKnowLM 是一个开源的知识增强大语言模型框架,旨在提升大模型在知识密集型任务上的表现。它通过整合外部知识库、知识图谱和结构化数据,在预训练、微调和推理阶段注★ 1,386
z80aiZ80-μLM 是一个极致的微型语言模型项目,通过2比特量化技术,将对话模型压缩到能在8位Z80处理器上运行的程度。它解决了复古计算机无法运行现代AI模型的问题★ 1,127