lora

本站收录 107 个带「lora」标签的 AI 开源项目(按 GitHub 星标从高到低,此处展示前 50 个)

LlamaFactory统一的 LLM 高效微调框架,支持 100+ 主流模型(LLM 与 VLM),集成 LoRA 等前沿技术,被 ACL 2024 收录,是微调领域最流行的开源工具★ 75,189airllmAirLLM 是一个针对大模型推理优化的开源工具,核心目标是让 70B 级别的超大模型能够在仅 4GB 显存的单张 GPU 上运行。它通过分层推理和显存卸载技术★ 35,207self-llmself-llm 是一个面向中文用户的开源大模型教程项目,旨在帮助开发者快速上手国内外开源大模型(LLM)和多模态大模型(MLLM)的微调与部署。项目基于 Li★ 32,359peftPEFT 是一个专注于参数高效微调(Parameter-Efficient Fine-Tuning)的 Python 库,由 Hugging Face 团队维护★ 21,737Chinese-LLaMA-AlpacaChinese-LLaMA-Alpaca 是一个专注于中文大语言模型的开源项目,旨在将 Meta 的 LLaMA 和 Stanford 的 Alpaca 模型进★ 18,939stable-diffusion-webui-colabstable-diffusion-webui-colab 是一个基于 Google Colab 的 Stable Diffusion WebUI 一键部署方案。★ 15,915ms-swiftms-swift 是魔搭社区推出的国产大模型全流程训练与部署工具,旨在解决开发者微调大模型时面临的框架割裂、上手门槛高、多模态支持不足等痛点。它支持从增量预训练★ 15,754ARTART(Agent Reinforcement Trainer)是一个面向真实世界多步骤任务的开源强化学习训练框架,专注于使用GRPO算法对智能体进行在线训练。★ 10,781SoupSoup 是一个用于微调大语言模型(LLM)的开源工具,它通过一个 YAML 配置文件即可完成整个微调流程,极大简化了操作。其核心亮点是采用“层流式训练”(La★ 7,822loraLoRA(低秩适应)是一种高效的模型微调技术,最初由微软提出,此项目将其应用于扩散模型(如Stable Diffusion)的快速微调。它通过冻结预训练模型的权★ 7,559ReticulumReticulum 是一个基于密码学的网络协议栈,旨在构建不可阻挡的通信网络。它解决了传统互联网依赖中心化基础设施、易受审查和单点故障的问题,允许通过 LoRa★ 7,419FireflyFirefly 是一个开源的大模型训练工具,专注于高效微调和训练各类主流大语言模型。它解决了开发者在使用不同模型架构时训练流程不统一、配置复杂的问题,提供了一套★ 6,653lora-scriptslora-scripts 是一个基于 kohya-ss 训练器的 Stable Diffusion 模型训练工具,提供 LoRA 和 Dreambooth 训练★ 6,153transformerlab-appTransformer Lab 是一个面向 AI 研究者的开源研究环境,旨在让模型训练、评估和扩展变得无缝流畅,支持从本地硬件到 GPU 集群的灵活部署。它解决★ 5,195nunchakununchaku 是 ICML 2025 Spotlight 论文 SVDQuant 的官方开源实现,专注于 4-bit 扩散模型的量化推理与微调。它通过低秩组★ 3,958loraxLorax 是一个专为大规模多 LoRA 推理而设计的高性能服务器,能够同时承载数千个微调后的 LLM。它解决了传统推理服务中每个微调模型需要独立部署、资源消耗★ 3,834MetaClawMetaClaw 是一个让 AI 智能体通过对话持续进化的开源框架。它解决的是传统智能体在部署后能力固化、无法从交互中学习的问题。其核心能力是结合元学习、在线学★ 3,492OneTrainerOneTrainer 是一个面向扩散模型(Diffusion Model)的一站式训练工具,旨在简化图像生成模型的微调与训练流程。它解决了 Stable Dif★ 3,219LLM-FinetuningLLM-Finetuning 是一个专注于大语言模型微调的开源项目,基于 PEFT(Parameter-Efficient Fine-Tuning)库实现。它旨★ 2,986Alpaca-CoTAlpaca-CoT 是一个面向大语言模型(LLM)的指令微调统一平台,旨在解决研究人员在微调过程中面临的数据格式不统一、模型适配复杂、参数高效方法集成困难等问★ 2,789LongLoRALongLoRA 是一个针对大语言模型的长上下文微调方案,由 MIT 等机构提出,相关论文入选 ICLR 2024 Oral。它解决了在有限算力下将预训练模型(★ 2,686xTuringxTuring 是一个面向个人和团队的开源大语言模型(LLM)个性化工具,旨在简化从数据预处理到模型微调的全流程。它解决了普通开发者难以快速上手 LLM 微调的★ 2,675magistralaMagistrala 是一个用 Go 语言构建的开源物联网平台框架,原名 Mainflux。它旨在为工业物联网(IIoT)、边缘计算和智能设备提供一套灵活、可扩★ 2,643YAYI雅意大模型是面向企业客户的中文大语言模型系列,基于LlaMA2和BLOOM架构,由中科闻歌算法团队研发。项目核心是提供安全可靠的专属大模型解决方案,通过大规模中★ 2,526onediffOneDiff 是一个开箱即用的扩散模型加速库,专门针对 Stable Diffusion 等图像生成模型进行推理优化。它解决了扩散模型生成速度慢、部署成本高的★ 1,965sonarsonar 是一个面向大规模 LLM 推理场景的高性能引擎,用 C++ 编写,旨在解决大模型部署时的高延迟、低吞吐和硬件适配问题。它支持多种硬件后端,包括 NV★ 1,869mlx-tunemlx-tune 是一个专为 Apple Silicon Mac 设计的 LLM 微调工具,基于 MLX 框架原生运行,让开发者无需云端 GPU 即可在本地完成★ 1,414KnowLMKnowLM 是一个开源的知识增强大语言模型框架,旨在提升大模型在知识密集型任务上的表现。它通过整合外部知识库、知识图谱和结构化数据,在预训练、微调和推理阶段注★ 1,386TinyEngramTinyEngram 是一个基于 Qwen-3 和 Stable Diffusion 系列模型的研究项目,旨在复现并验证 DeepSeek 的 Engram 架★ 1,376MOVAMOVA 是一个统一的多模态基础模型,能够在一个模型中同时生成同步的视频和音频,解决了传统视频生成中音画分离、需要额外配音或后期对齐的痛点。它基于扩散模型架构,★ 1,119chirpstackChirpStack 是一个开源的 LoRaWAN 网络服务器,用于构建和管理 LoRaWAN 物联网网络。它解决了物联网设备通过 LoRaWAN 协议接入互联★ 1,114alexandria-audiobookAlexandria 是一个基于 AI 的多角色有声书生成器,解决传统 TTS 只能单一音色、缺乏情感和角色区分的问题。它利用 LLM 对书籍文本进行脚本标注,★ 1,041DoRADoRA(权重分解低秩适配)是ICML 2024口头报告论文的官方PyTorch实现,一种参数高效微调方法。它通过将预训练权重分解为幅度和方向两个分量,并对方向★ 1,000LLM-Finetuning-ToolkitLLM-Finetuning-Toolkit 是一个面向开源大语言模型的微调、消融和单元测试工具包。它主要解决研究人员和开发者在对 LLM 进行定制化训练时缺乏★ 870FineTuningLLMs这是一个配套书籍《使用PyTorch和Hugging Face微调LLMs的实践指南》的官方代码仓库,以Jupyter Notebook形式提供大量可运行的微调★ 869refinersrefiners 是一个基于 PyTorch 的微框架,旨在为基础模型适配提供一流的 API。它解决了扩散模型(如 Stable Diffusion)在微调、适★ 834doc-to-loradoc-to-lora 是一个让大语言模型通过超网络(Hypernetworks)动态生成 LoRA 权重来记住事实信息的开源项目。它解决的是 LLM 在长对话★ 828Lora-for-Diffusers这是一个面向AI图像生成研究者的LoRA微调教程项目,旨在用最易懂的方式讲解如何在diffusers框架中使用LoRA(低秩适配)技术。项目解决了Stable ★ 822haloHalo 是由 White Circle 开源的大语言与多模态模型训练框架,用 Python 编写。它面向从微调到强化学习后训练的完整流程,核心能力包括分布式训★ 798can-i-finetune-this这是一个帮助开发者快速判断 Hugging Face 上的模型能否在本地 GPU 上进行微调的工具。它通过分析模型的参数量、架构和精度,结合用户 GPU 的显存★ 792AntiHunterAntiHunter 是一个基于 ESP32 和 LoRa 的周边防御系统固件,专为数字节点(DIGI Node)设计。它解决的是在野外或敏感区域中,如何通过无★ 689ai-engineer-notebooks这是一个面向AI工程师和前沿部署工程师(FDE)的实战型Jupyter Notebook合集,完全基于免费Groq API运行,无需框架依赖。项目覆盖了从模型A★ 662RandOptRandOpt 是 ICML 2026 Spotlight 论文《Neural Thickets: Diverse Task Experts Are Dense★ 648lora-svclora-svc 是一个基于 Whisper 和 LoRA 技术的歌声转换与克隆开源项目。它解决的核心问题是:如何用少量目标歌手的音频数据,快速克隆其音色并实现★ 646END-TO-END-GENERATIVE-AI-PROJECTS这是一个汇集端到端生成式AI行业项目的开源仓库,专注于大语言模型(LLM)的完整落地流程,从数据准备、模型微调、推理优化到部署上线。项目旨在为开发者提供可直接参★ 635awesome-ltx2awesome-ltx2 是一个围绕 LTX-2 视频生成模型的资源聚合仓库,由 Lightricks 官方维护。它集中收录了 LTX-2 相关的所有可用模型权★ 597LoongForgeLoongForge 是一个面向大模型训练的统一高性能框架,支持在 NVIDIA GPU 和昆仑芯 XPU 上训练 LLM、VLM、扩散模型及具身智能模型。它解★ 582comfyUI-Realtime-Lora这是一个 ComfyUI 的插件,让你直接在 ComfyUI 界面里训练、编辑和保存 LoRA 模型,无需切换到外部训练工具。它支持多种基础模型,包括 Z-im★ 566AI-Toolkit-Easy-InstallAI-Toolkit-Easy-Install 是一个为 Windows 用户提供的一键便携式安装工具,专门用于安装 Ostris 开发的 AI-Toolkit★ 521VibeVoiceFusionVibeVoiceFusion 是一个基于微软 VibeVoice(自回归+扩散架构)的全栈多说话人语音合成 Web 系统。它主要解决自建 TTS 系统时面临的★ 490