llama

本站收录 242 个带「llama」标签的 AI 开源项目(按 GitHub 星标从高到低,此处展示前 50 个)

ollama最流行的本地大模型运行工具,用 Go 编写,一条命令即可在本地跑起 Kimi、DeepSeek、Qwen、Gemma、GLM 等主流开源模型,无需复杂配置,兼顾★ 181,923vllm面向 LLM 的高吞吐、内存高效的推理与 serving 引擎,支持 PagedAttention 等核心技术,是大规模模型部署与在线服务的事实标准之一。★ 92,945unsloth本地运行与训练文本、扩散模型的 UI 工具,支持 Kimi、Gemma、Qwen3.6、DeepSeek-V4、FLUX 等最新模型,让个人开发者也能轻松微调与★ 77,026LlamaFactory统一的 LLM 高效微调框架,支持 100+ 主流模型(LLM 与 VLM),集成 LoRA 等前沿技术,被 ACL 2024 收录,是微调领域最流行的开源工具★ 75,189LocalAI开源的本地 AI 推理引擎,无需 GPU 即可在任何硬件上运行 LLM、视觉、语音、图像与视频等多种模型,兼容 OpenAI API 接口,是构建私有化 AI ★ 49,323aideraider 是一个运行在终端里的 AI 结对编程工具,通过命令行界面与 GPT-4、Claude 3、Gemini 等主流大模型对话,直接对本地代码库进行编辑和★ 49,278AstrBot集成众多 IM 平台、LLM、插件与 AI 功能的智能体助手与开发框架。支持 QQ、微信等多种即时通讯渠道,功能可扩展,亦可作为 OpenClaw 的开源替代方★ 41,211Langchain-Chatchat基于 Langchain 与 ChatGLM、Qwen、Llama 等大语言模型构建的本地知识库 RAG 与 Agent 应用。支持文档问答、知识检索与智能体编★ 38,666sglangSGLang 是一个高性能的大语言模型和多模态模型服务框架,旨在解决 LLM 推理服务中吞吐量低、延迟高、显存利用率不足等问题。它通过 RadixAttenti★ 36,594airllmAirLLM 是一个针对大模型推理优化的开源工具,核心目标是让 70B 级别的超大模型能够在仅 4GB 显存的单张 GPU 上运行。它通过分层推理和显存卸载技术★ 35,207fish-speechfish-speech 是一个开源的文本转语音(TTS)模型,基于 VQGAN 和 Llama 架构,实现了目前最先进的语音合成效果。它解决了传统 TTS 系统★ 32,888repomix强大的代码仓库打包工具,将整个代码库压缩为单个 AI 友好的文件,方便直接投喂给 Claude、ChatGPT、DeepSeek、Perplexity、Gemi★ 28,585LLaVA视觉指令微调(Visual Instruction Tuning)的开创性工作,NeurIPS 2023 Oral 论文。通过指令微调赋予视觉语言模型 GPT-★ 25,045Awesome-Chinese-LLMAwesome-Chinese-LLM 是一个精选中文大语言模型资源的开源项目,旨在整理和汇总国内开源的中文大模型,尤其侧重规模较小、可私有化部署、训练成本较低★ 22,774Chinese-LLaMA-AlpacaChinese-LLaMA-Alpaca 是一个专注于中文大语言模型的开源项目,旨在将 Meta 的 LLaMA 和 Stanford 的 Alpaca 模型进★ 18,939llama-cookbookllama-cookbook 是 Meta 官方推出的 Llama 模型实战指南,以 Jupyter Notebook 形式提供从推理、微调到 RAG 的完整教★ 18,559ms-swiftms-swift 是魔搭社区推出的国产大模型全流程训练与部署工具,旨在解决开发者微调大模型时面临的框架割裂、上手门槛高、多模态支持不足等痛点。它支持从增量预训练★ 15,754ChuanhuChatGPT支持 ChatGPT API 与众多 LLM 的图形化客户端。内置 Agent、文件问答、GPT 微调与联网搜索功能,界面简洁美观,让大模型应用更顺手、更高效。★ 15,276Llama-ChineseLlama-Chinese 是 Llama 中文社区维护的开源项目,旨在构建最好的中文 Llama 大模型开源生态。它实时汇总最新的 Llama 学习资料,提供★ 14,762langchain4jLangChain4j 是一个面向 JVM 生态的 Java 开源库,旨在为构建 LLM 驱动的应用提供地道、简洁的开发体验。它解决了 Java 开发者难以像 ★ 13,176PaddleNLPPaddleNLP 是百度飞桨生态下的自然语言处理库,定位为易用且强大的大模型与小模型库,内置丰富的模型动物园。它解决从文本分类、序列标注到大规模预训练模型微调★ 12,981dalaidalai 是一个让普通用户能一键在本地运行 LLaMA 大语言模型的工具,旨在解决 LLaMA 模型部署门槛高、依赖复杂的问题。它通过简单的命令行界面,自动完★ 12,891OpenLLM让任意开源 LLM(如 DeepSeek、Llama)一键以 OpenAI 兼容的 API 形式部署到云端的工具。它屏蔽了模型服务化的复杂度,提供标准化的推理接★ 12,548shell_gptshell_gpt 是一个基于大语言模型的命令行生产力工具,将 AI 能力直接嵌入终端环境。它解决的是用户在 shell 中频繁查询命令、编写脚本、解释错误信息★ 12,289bishengbisheng 是一个面向企业级 AI 应用的开源 LLM DevOps 平台,旨在解决大模型应用从开发到上线的全生命周期管理问题。它提供 GenAI 工作流编★ 12,015ludwigLudwig 是一个基于 Python 的低代码机器学习框架,旨在让开发者无需编写大量底层代码即可构建、训练和部署定制化的大语言模型、神经网络及其他 AI 模型★ 11,771tensorzero开源的 LLMOps 平台,将 LLM 网关、可观测性、评估、优化与实验管理整合于一体。团队可以在统一界面中路由模型请求、追踪调用质量并持续调优提示词与模型组合★ 11,715llama-gptllama-gpt 是一个完全自托管的离线聊天机器人,由 Llama 2 模型驱动,提供类似 ChatGPT 的交互体验。它解决了用户在使用云端 AI 服务时对★ 10,936petalsPetals 是一个去中心化的 LLM 推理与微调框架,采用 BitTorrent 风格的点对点网络,将大型语言模型(如 Llama、Falcon、BLOOM)★ 10,592YuEYuE 是开源的全曲目音乐生成基础模型,功能类似 Suno.ai 但完全开放。支持生成带人声的完整歌曲,涵盖歌词、旋律与编曲,为音乐创作者提供可本地部署、可自由★ 10,578PowerInferPowerInfer 是一个面向本地部署的高速大语言模型推理引擎,专注于在消费级硬件上实现接近服务器级的推理速度。它通过利用大语言模型推理中的高稀疏性(即神经元★ 9,815oumioumi 是一个专注于开源大语言模型(LLM)微调、评估和部署的全流程工具包。它旨在简化从模型选择到生产部署的复杂流程,支持 Qwen、Gemma、Llama ★ 9,392awesome-LLM-resources这是一个精选的LLM(大语言模型)资源合集,汇总了全球范围内关于多模态生成、Agent、辅助编程、AI审稿、数据处理、模型训练与推理、o1模型、MCP、小语言模★ 8,991reorreor 是一款面向高熵人群的本地优先、注重隐私的个人知识管理应用。它利用 AI 技术(如嵌入模型和向量检索)自动建立笔记之间的语义关联,帮助用户在大量碎片化信★ 8,549OperitOperit 是一款运行在 Android 平台上的 AI Agent 与 AI 聊天软件,主打“能力最强”与“发展最久”。它基于 Kotlin 开发,旨在将大★ 8,229GPTCacheGPTCache 是一个面向大语言模型(LLM)的语义缓存工具,核心解决 LLM 推理成本高、响应慢的问题。它通过缓存相似的查询结果,让重复或相近的请求直接命中★ 8,206lmdeployLMDeploy 是一个专为大语言模型(LLM)设计的压缩、部署和服务工具包。它解决了 LLM 在实际生产环境中推理速度慢、显存占用高、部署复杂等核心问题。其核★ 8,100mergekitmergekit 是一个用于合并预训练大语言模型(LLM)的工具集。它解决了模型合并过程中繁琐的工程问题,让开发者能够轻松地将多个模型的能力融合到一个模型中。其★ 7,382Chinese-LLaMA-Alpaca-2Chinese-LLaMA-Alpaca-2 是面向中文场景的 LLaMA-2 和 Alpaca-2 大语言模型二期开源项目,旨在解决原版 LLaMA-2 中文★ 7,114llm-scraperllm-scraper 是一个基于 TypeScript 的开源库,利用大语言模型将任意网页转换为结构化数据。它解决了传统网页抓取工具依赖固定选择器、难以应对页★ 6,939FireflyFirefly 是一个开源的大模型训练工具,专注于高效微调和训练各类主流大语言模型。它解决了开发者在使用不同模型架构时训练流程不统一、配置复杂的问题,提供了一套★ 6,653Liger-KernelLiger-Kernel 是 LinkedIn 开源的一套面向大语言模型训练的 Triton 内核集合,目标是解决 LLM 微调与训练中显存占用高、计算效率低的★ 6,636enchantedEnchanted 是一款专为 iOS 和 macOS 设计的原生聊天应用,旨在让用户通过 Ollama 与本地托管的开源大语言模型(如 Llama2、Mist★ 6,006MedicalGPTMedicalGPT 是一个开源项目,旨在帮助开发者训练自己的医疗领域大语言模型。它提供了一套完整的训练流水线,覆盖了从增量预训练(PT)、有监督微调(SFT)★ 5,846higgsfieldhiggsfield 是一个面向超大规模模型训练的容错型 GPU 编排与机器学习框架,专为数十亿至数万亿参数模型设计。它解决的核心问题是:在大规模分布式训练中,★ 5,812lemonadeLemonade 是一个面向本地 AI 应用的开源推理引擎,旨在让用户直接在自己的 GPU 和 NPU 上运行优化后的大语言模型。它解决了云端 AI 带来的隐私★ 5,797gpustackgpustack 是一个面向高性能 AI 模型服务的 GPU 集群管理器,专注于简化 vLLM、SGLang 等推理引擎的部署与运维。它解决了 GPU 资源利用★ 5,768transformerlab-appTransformer Lab 是一个面向 AI 研究者的开源研究环境,旨在让模型训练、评估和扩展变得无缝流畅,支持从本地硬件到 GPU 集群的灵活部署。它解决★ 5,195h2o-llmstudioH2O LLM Studio 是一个用于大语言模型(LLM)微调的开源框架和无代码图形界面(GUI)。它解决了开发者微调 LLM 时面临的高技术门槛和复杂流程问★ 5,184tiny-universetiny-universe 是一个以 Jupyter Notebook 形式呈现的大模型教学项目,旨在通过从零手搓的方式,帮助学习者深入理解大模型的内部工作原理★ 5,080