llama2
本站收录 65 个带「llama2」标签的 AI 开源项目(按 GitHub 星标从高到低,此处展示前 50 个)
LLaVA视觉指令微调(Visual Instruction Tuning)的开创性工作,NeurIPS 2023 Oral 论文。通过指令微调赋予视觉语言模型 GPT-★ 25,045
llama-cookbookllama-cookbook 是 Meta 官方推出的 Llama 模型实战指南,以 Jupyter Notebook 形式提供从推理、微调到 RAG 的完整教★ 18,559
OpenLLM让任意开源 LLM(如 DeepSeek、Llama)一键以 OpenAI 兼容的 API 形式部署到云端的工具。它屏蔽了模型服务化的复杂度,提供标准化的推理接★ 12,548
h2ogpth2oGPT 是一个由 H2O.ai 开发的私有化大语言模型聊天助手,旨在让用户完全掌控自己的数据,实现 100% 私密的本地 AI 对话。它解决了企业或个人在★ 11,959
ludwigLudwig 是一个基于 Python 的低代码机器学习框架,旨在让开发者无需编写大量底层代码即可构建、训练和部署定制化的大语言模型、神经网络及其他 AI 模型★ 11,771
llama-gptllama-gpt 是一个完全自托管的离线聊天机器人,由 Llama 2 模型驱动,提供类似 ChatGPT 的交互体验。它解决了用户在使用云端 AI 服务时对★ 10,936
lmdeployLMDeploy 是一个专为大语言模型(LLM)设计的压缩、部署和服务工具包。它解决了 LLM 在实际生产环境中推理速度慢、显存占用高、部署复杂等核心问题。其核★ 8,100
Chinese-LLaMA-Alpaca-2Chinese-LLaMA-Alpaca-2 是面向中文场景的 LLaMA-2 和 Alpaca-2 大语言模型二期开源项目,旨在解决原版 LLaMA-2 中文★ 7,114
FireflyFirefly 是一个开源的大模型训练工具,专注于高效微调和训练各类主流大语言模型。它解决了开发者在使用不同模型架构时训练流程不统一、配置复杂的问题,提供了一套★ 6,653
enchantedEnchanted 是一款专为 iOS 和 macOS 设计的原生聊天应用,旨在让用户通过 Ollama 与本地托管的开源大语言模型(如 Llama2、Mist★ 6,006
higgsfieldhiggsfield 是一个面向超大规模模型训练的容错型 GPU 编排与机器学习框架,专为数十亿至数万亿参数模型设计。它解决的核心问题是:在大规模分布式训练中,★ 5,812
h2o-llmstudioH2O LLM Studio 是一个用于大语言模型(LLM)微调的开源框架和无代码图形界面(GUI)。它解决了开发者微调 LLM 时面临的高技术门槛和复杂流程问★ 5,184
Baichuan2Baichuan2 是百川智能推出的系列大语言模型,包括基座模型和对话模型,覆盖 7B、13B 等参数规模。它旨在提供高质量的中英文双语能力,解决通用对话、内容★ 4,084
LLamaSharpLLamaSharp 是一个面向 C#/.NET 开发者的本地大语言模型推理库,基于 llama.cpp 的高效 C++ 内核封装,提供纯托管代码的 API 接★ 3,804
distributed-llamadistributed-llama 是一个用 C++ 实现的开源项目,旨在将家庭中的多台设备(如电脑、树莓派等)组成一个分布式集群,共同运行 Llama 大语言★ 3,082
llm_aided_ocrllm_aided_ocr 是一个利用大语言模型(LLM)增强 Tesseract OCR 输出的开源工具。它解决传统 OCR 识别率低、输出格式杂乱的问题,通★ 3,004
LLM-FinetuningLLM-Finetuning 是一个专注于大语言模型微调的开源项目,基于 PEFT(Parameter-Efficient Fine-Tuning)库实现。它旨★ 2,986
YAYI雅意大模型是面向企业客户的中文大语言模型系列,基于LlaMA2和BLOOM架构,由中科闻歌算法团队研发。项目核心是提供安全可靠的专属大模型解决方案,通过大规模中★ 2,526
codelcodel 是一个基于 TypeScript 构建的全自主 AI 智能体,旨在通过终端、浏览器和编辑器三大核心工具,自动完成复杂任务和项目。它解决了传统 AI ★ 2,475
maxtextMaxText 是一个基于 JAX 构建的高性能、可扩展的大型语言模型(LLM)训练与推理框架,由 Google 开源。它旨在解决训练超大规模模型时面临的复杂性★ 2,433
TigerBotTigerBot 是一个多语言、多任务的大语言模型开源项目,由虎博科技开发。它旨在提供高性能的对话、生成、理解等能力,并针对中文场景做了优化。项目包含模型权重、★ 2,262
Chinese-Llama-2-7bChinese-Llama-2-7b 是开源社区第一个提供可下载、可运行的中文 LLaMA2 模型,基于 Meta 的 LLaMA2-7B 进行中文增强训练。它★ 2,204
AISuperDomainAila(AI超元域)是一款面向Windows、macOS和Android的AI聚合集成工具。它允许用户一次性提问,同时获取来自ChatGPT、Gemini、C★ 1,997
llama2-webuillama2-webui 是一个让你在本地轻松运行 Llama 2 大语言模型的工具,它基于 Gradio 构建了直观的网页界面,支持在 GPU 或 CPU 上★ 1,934
LLMCompilerLLMCompiler 是一个面向大语言模型(LLM)的函数调用并行化框架,源自 ICML 2024 论文。它借鉴传统编译器思想,将复杂的多步骤任务分解为依赖图★ 1,890
llm-applications这是一个面向生产环境的 RAG(检索增强生成)LLM 应用构建指南,基于 Jupyter Notebook 形式提供系统化教程。项目由 Anyscale 团队维★ 1,860
gpu_poorgpu_poor 是一个用于估算任意大语言模型(LLM)在本地部署时所需 GPU 显存和推理速度(token/s)的命令行工具。它通过解析模型的参数量、量化方式★ 1,400
chatdchatd 是一个让用户通过本地 AI 与文档进行对话的开源工具。它解决了传统文档检索效率低、信息查找不便的问题,允许用户直接以自然语言提问,从本地文档中获取精★ 1,079
KG_RAGKG_RAG 是一个基于知识图谱的检索增强生成(RAG)框架,旨在增强大语言模型在知识密集型任务上的表现。它通过将知识图谱的结构化知识与 LLM 的生成能力相结★ 947
LLM-Finetuning-ToolkitLLM-Finetuning-Toolkit 是一个面向开源大语言模型的微调、消融和单元测试工具包。它主要解决研究人员和开发者在对 LLM 进行定制化训练时缺乏★ 870
AlignLLMHumanSurvey这是一个关于大语言模型与人类对齐(Alignment)的综述资源库,系统梳理了让 LLM 输出符合人类意图、价值观和偏好的技术路线。项目围绕指令微调、RLHF、★ 738
GromaGroma 是一个基于多模态大语言模型(MLLM)的视觉定位模型,核心创新在于“局部视觉标记化”(Localized Visual Tokenization)。★ 586
LLM-FineTuning-Large-Language-Models该项目是一个专注于大语言模型(LLM)微调的教学型开源仓库,主要使用 Jupyter Notebook 编写,旨在帮助开发者系统学习和实践大模型微调技术。它解决★ 578
AnglEAnglE是一个用于训练和推理高质量句子嵌入(Sentence Embeddings)的Python开源库,旨在解决文本语义相似度计算、检索和聚类等任务中嵌入表★ 575
llmgraphllmgraph 是一个利用大语言模型(LLM)自动从文本中抽取实体和关系,并生成知识图谱的开源工具。它解决了手动构建知识图谱耗时费力的问题,用户只需输入文本或★ 509
edsledsl 是一个用于设计、执行和分析 AI 驱动调查与实验的开源 Python 框架。它解决的核心问题是:传统社会科学和市场研究依赖真人样本,成本高、周期长,且★ 502
step_into_llmStep into LLM 是华为 MindSpore 社区推出的大语言模型入门课程项目,以 Jupyter Notebook 为载体,系统讲解从 BERT、G★ 480
JetStreamJetStream 是一个面向 XLA 设备(当前以 TPU 为主,未来计划支持 GPU)的 LLM 推理引擎,专注于提升吞吐量和优化内存使用。它解决了在 TP★ 461
llama2llama2 是一个基于 Meta 开源的 Llama 2 大语言模型构建的聊天机器人应用。它主要解决开发者快速搭建本地或私有化部署的对话式 AI 界面的问题,★ 381
HackBotHackBot 是一个由 AI 驱动的网络安全聊天机器人,旨在为网络安全相关问题提供准确、实用的解答,并支持代码分析和扫描分析。它基于 Python 构建,集成★ 365
ViP-LLaVAViP-LLaVA是CVPR 2024收录的多模态大模型,旨在让模型理解任意视觉提示(如点、框、涂鸦等),而不仅限于文本指令。它解决了现有视觉语言模型只能处理全★ 338
chat.petals.devchat.petals.dev 是一个基于 Petals 分布式推理系统的聊天机器人 Web 应用,同时提供 HTTP 和 WebSocket 接口,用于大语言★ 321
picollmpicollm 是一个专注于设备端(on-device)大语言模型推理的开源项目,通过 X-Bit 量化技术实现高效的模型压缩与推理。它支持 Gemma、Lla★ 318
wordflowWordflow 是一款基于 TypeScript 开发的开源 AI 写作助手,定位为社交化且高度可定制的写作工具。它解决了传统写作工具缺乏个性化与社交互动的问★ 271
foundation-model-benchmarking-tool这是一个用于基础模型(大模型)基准测试的开源工具,旨在帮助用户在 AWS 云平台上运行任意模型,并对比不同实例类型和服务栈(serving stack)的性能表★ 256
unsagedunsaged 是一个开源的 AI 对话助手工具包,旨在提供与多种 AI 模型的无缝交互体验。它基于 TypeScript 构建,集成了包括 Anthropic★ 253
sendbird-uikit-reactSendbird UIKit React 是一个基于 React 的开源聊天 UI 组件库,由 Sendbird 公司维护。它旨在帮助开发者快速构建聊天应用,通★ 240
HacxGPT-Jailbreak-promptsHacxGPT-Jailbreak-prompts 是一个专门收集和分享 AI 模型越狱提示词(Jailbreak prompts)的开源项目,旨在解锁 Cha★ 209
J.A.R.V.I.SJ.A.R.V.I.S 是一个以漫威宇宙中的智能管家为灵感命名的开源项目,目前处于早期阶段。它旨在打造一个类似钢铁侠中 Jarvis 的智能助手,解决用户对个性★ 183
get-startedget-started 是一个面向 Ollama 的云原生部署堆栈,旨在将本地运行的 Ollama 模型服务扩展到云端。它解决的核心问题是:如何让基于 Olla★ 180