instruction-tuning

本站收录 37 个带「instruction-tuning」标签的 AI 开源项目

LLMs-from-scratch手把手教你用 PyTorch 从零实现一个 ChatGPT 级别的 LLM,逐行讲解代码与原理,是深入理解 Transformer 架构与大模型训练的最佳学习路★ 105,758LlamaFactory统一的 LLM 高效微调框架,支持 100+ 主流模型(LLM 与 VLM),集成 LoRA 等前沿技术,被 ACL 2024 收录,是微调领域最流行的开源工具★ 75,189LLaVA视觉指令微调(Visual Instruction Tuning)的开创性工作,NeurIPS 2023 Oral 论文。通过指令微调赋予视觉语言模型 GPT-★ 25,045Awesome-Multimodal-Large-Language-Models这是一个持续更新的多模态大语言模型(MLLM)资源清单,汇总了领域内最新进展,包括论文、模型、数据集和工具。项目按模型架构、任务类型和应用场景分类整理,覆盖从视★ 18,040LLMSurveyLLMSurvey 是《A Survey of Large Language Models》论文的官方 GitHub 页面,旨在系统梳理大语言模型领域的发展脉络★ 12,224data-juicerData-Juicer 是一个面向大模型的数据处理与分析工具,旨在解决模型训练数据质量参差不齐、处理流程繁琐低效的问题。它提供了一套系统化的数据加工流水线,包含★ 7,105NExT-GPTNExT-GPT是新加坡国立大学团队在ICML 2024发表的任意模态大语言模型,支持文本、图像、音频和视频的任意输入与输出组合。它采用LLM作为核心大脑,通过★ 3,636OtterOtter是一个基于OpenFlamingo的多模态模型,旨在提升视觉-语言任务的指令跟随和上下文学习能力。它针对DeepMind Flamingo的开源版本进★ 3,443DecryptPromptDecryptPrompt 是一个聚焦大语言模型(LLM)与提示工程(Prompt Engineering)的开源知识库,旨在系统性地整理和解读该领域的前沿论文★ 3,441InternLM-XComposerInternLM-XComposer 是上海人工智能实验室推出的多模态大模型系统,最新版本 2.5-OmniLive 专注于长时流式视频与音频的实时交互。它解决★ 2,928Alpaca-CoTAlpaca-CoT 是一个面向大语言模型(LLM)的指令微调统一平台,旨在解决研究人员在微调过程中面临的数据格式不统一、模型适配复杂、参数高效方法集成困难等问★ 2,789mPLUG-OwlmPLUG-Owl是阿里巴巴达摩院开发的多模态大语言模型家族,旨在让AI同时理解文本和图像,并基于指令进行对话。它解决了传统语言模型只能处理文本、无法理解视觉信★ 2,539InternVideoInternVideo 是一个面向多模态理解的开源视频基础模型项目,由上海人工智能实验室发布,相关论文发表于 ECCV2024。它旨在解决视频理解中模型泛化能力★ 2,398cambrianCambrian-1 是一个以视觉为中心设计的开源多模态大语言模型(MLLM)家族。它解决的是当前多模态模型在视觉感知能力上受限的问题,强调通过视觉中心的设计来★ 2,011curatorcurator 是一个专注于合成数据策展的开源工具,主要服务于大语言模型的后训练阶段和结构化数据提取。它解决了高质量训练数据难以获取、合成数据质量参差不齐的问题★ 1,736KnowLMKnowLM 是一个开源的知识增强大语言模型框架,旨在提升大模型在知识密集型任务上的表现。它通过整合外部知识库、知识图谱和结构化数据,在预训练、微调和推理阶段注★ 1,386DataDreamerDataDreamer 是一个专注于合成数据生成与模型训练对齐的开源 Python 库。它解决的核心问题是:在真实数据稀缺或受隐私限制时,如何通过提示词(Pro★ 1,121DoRADoRA(权重分解低秩适配)是ICML 2024口头报告论文的官方PyTorch实现,一种参数高效微调方法。它通过将预训练权重分解为幅度和方向两个分量,并对方向★ 1,000deitaDeita 是一个专注于数据高效指令微调的开源项目,旨在解决大语言模型对齐过程中数据质量参差不齐、训练成本高昂的问题。它通过自动筛选高质量指令数据,用更少的数据★ 604xmtfxmtf 是一个通过多任务微调实现跨语言泛化的开源模型项目。它主要解决多语言自然语言处理中,模型在低资源语言上性能不佳的问题。项目基于多任务学习框架,在多个语言★ 533step_into_llmStep into LLM 是华为 MindSpore 社区推出的大语言模型入门课程项目,以 Jupyter Notebook 为载体,系统讲解从 BERT、G★ 480UrbanGPTUrbanGPT 是一个面向城市时空数据的大语言模型,发表于 KDD 2024。它旨在解决传统时空预测模型难以泛化到未见城市或区域的问题,通过将大语言模型与时空★ 460OlympusOlympus 是一个面向计算机视觉任务的通用任务路由器,由 CVPR 2025 Highlight 论文官方开源。它旨在解决多模态大模型(如 LLaVA)在处★ 427lmms-finetunelmms-finetune 是一个极简的多模态大模型微调代码库,旨在降低 LMM(Large Multimodal Model)微调的门槛。它支持多种主流模型,★ 376BayLingBayLing(百聆)是一个基于LLaMA的中英双语大语言模型,通过语言对齐增强技术,在英语和中文的生成、指令跟随及多轮交互上表现优异,官方称在多项测试中达到C★ 317LLaVARLLaVAR 是一个面向文本密集型图像理解的多模态对话助手,基于 LLaVA 架构进行增强,通过指令微调提升模型对图像中文字内容的识别与推理能力。它解决了传统视★ 268BLIVABLIVA是一个基于多模态大语言模型的视觉问答助手,专注于处理包含大量文本的视觉问题,如文档截图、路牌、菜单等场景。它通过结合BLIP-2的视觉编码能力和LLa★ 260instruction-tuned-sdinstruction-tuned-sd 是一个用于对 Stable Diffusion 进行指令微调(instruction tuning)的开源项目。它解决★ 250Instruction-Tuning-Survey这是一个针对大语言模型指令微调(Instruction Tuning)领域的系统性综述项目,基于同名论文《Instruction Tuning for Larg★ 232Awesome-LLM-Papers-Comprehensive-Topics这是一个精选大语言模型(LLM)论文与代码仓库的清单,覆盖了从基础架构、训练方法到应用落地等非常全面的主题。它旨在解决LLM领域信息过载、论文检索困难的问题,通★ 223INTERSINTERS 是一个面向搜索场景的大语言模型指令微调开源项目,源自同名论文。它旨在解决通用大模型在信息检索任务中表现不佳的问题,通过构建大规模的搜索指令数据集,★ 208coeditCoEdIT是一个基于指令微调的多任务文本编辑框架,源自EMNLP 2023论文。它通过将改写、语法纠错、风格转换等文本编辑任务统一为指令跟随形式,让用户用自然★ 146DrugAssistDrugAssist 是一个面向分子优化任务的大语言模型,发表于 Briefings In Bioinformatics。它针对药物研发中分子改写的核心需求,利★ 146RecLMRecLM 是一个面向推荐系统的指令微调框架,源自 ACL 2025 论文。它通过将推荐任务转化为指令遵循问题,对语言模型进行微调,使其能够理解并执行如“根据历★ 112llm-table-surveyllm-table-survey 是一个专注于大语言模型(LLM)在表格处理领域应用的资源汇总项目。它系统收集了相关论文、数据集、工具和基准测试,旨在帮助研究者★ 111DS2DS2 是 ICLR 2025 论文《Improving Data Efficiency via Curating LLM-Driven Rating Syst★ 102OkapiOkapi 是一个面向多语言场景的指令微调大语言模型项目,核心解决非英语语言(如中文、西班牙语、印地语等)在指令跟随和对话质量上表现不足的问题。项目基于 LLa★ 96