Qwen-VL-Series-Finetune
开源
用自有数据微调 Qwen-VL,快速得到专用视觉大模型
这是阿里云 Qwen-VL 系列多模态大模型的开源微调实现,面向需要让视觉语言模型适配自有数据的开发者···
汇聚全球AI模型训练与微调项目,LoRA、全参微调、蒸馏、训练框架工具大全。
共收录 524 个开源项目
Qwen-VL-Series-Finetune
开源
用自有数据微调 Qwen-VL,快速得到专用视觉大模型
这是阿里云 Qwen-VL 系列多模态大模型的开源微调实现,面向需要让视觉语言模型适配自有数据的开发者···
LLMNodeBed
开源
统一基准,对比LLM节点分类算法,复现ICML论文结果。
LLMNodeBed 是 ICML 2025 论文《A Comprehensive Analysis on LLM-based Node Classification Algo···
LongRecipe
开源
把长文本压缩成短序列,高效训练长上下文模型。
LongRecipe 是一个针对大语言模型长上下文泛化能力的高效训练方案。它通过模拟长序列训练效果,将长···
XTTSv2-Finetuning-for-New-Languages
开源
给XTTS v2添加新语言,微调后即可合成和克隆声音
XTTSv2-Finetuning-for-New-Languages 是一个针对 Coqui XTTS v2 模型进行多语言微调的开源工具,旨···
Target-Driven-Distillation
开源
让扩散模型蒸馏更快更稳,生成质量不掉线
Target-Driven-Distillation 是一个面向扩散模型的蒸馏加速框架,核心思想是引入目标时间步选择与解···
get_model
开源
模块化建模跨细胞类型转录调控,多模态数据一键训练
get_model 是一个模块化的多模态跨细胞类型转录调控模型框架。它旨在解决不同细胞类型中基因表达调···
FineTuningLLMs
开源
跟着书一步步微调大模型,从零跑通全流程
这是一个配套书籍《使用PyTorch和Hugging Face微调LLMs的实践指南》的官方代码仓库,以Jupyter Not···
Liger-Kernel
开源
不改模型结构,给 LLM 训练省显存提吞吐
Liger-Kernel 是 LinkedIn 开源的一套面向大语言模型训练的 Triton 内核集合,目标是解决 LLM 微调···
diffusers-torchao
开源
一键优化扩散模型,推理提速3倍,显存减半
diffusers-torchao 是一个专注于扩散模型优化的端到端配方库,由 Hugging Face 和 PyTorch 团队联合···
panda
开源
用补丁注意力搞定非线性动力学,论文级模型直接上手
panda 是一个面向非线性动力学系统的开源模型,基于“修补注意力”(Patched Attention)机制,相关···
ml-mdm
开源
用更少数据和算力,训出高质量文生图模型
ml-mdm 是苹果开源的文本到图像扩散模型训练框架,目标是在数据和算力都受限的条件下,依然能训练出···
OneGen
开源
一次前向传播,边生成边检索,让 LLM 知识问答更快更准。
OneGen 是一个针对大型语言模型(LLM)的高效统一生成与检索框架,发表于 EMNLP 2024。它解决了传统···
minimind
开源
两小时造出你的小模型,练手入门不求人
仅用 2 小时即可从零训练一个 64M 参数的小型 LLM,完整展示大模型从数据到训练的全过程,是初学者···
ktransformers
开源
单卡甚至纯CPU跑大模型,显存不够也能玩转MoE推理微调
KTransformers 是一个面向大语言模型推理与微调的开源异构优化框架,核心目标是让开发者在单台消费···
stable-pretraining
开源
一键搭建稳定可扩展的预训练流程,专注模型研究而非工程细节。
stable-pretraining 是一个用于预训练基础模型和世界模型的 Python 库,主打可靠、极简和可扩展。它···
RAG-FiT
开源
让大模型更懂检索结果,微调提升 RAG 问答准确率
RAG-FiT 是一个用于增强大语言模型在检索增强生成(RAG)任务中表现的微调框架。它解决了通用微调方···
Kiln
开源
一站式搞定 AI 系统开发:从数据标注到微调评估,全流程可视化协作
Kiln 是一个面向 AI 系统的全流程开发平台,旨在解决从数据准备到模型优化过程中工具链割裂、协作困···
lmms-finetune
开源
极简代码库,快速微调主流多模态大模型
lmms-finetune 是一个极简的多模态大模型微调代码库,旨在降低 LMM(Large Multimodal Model)微调···
VERONA
开源
一键搭建鲁棒性实验,快速算清模型抗干扰能力
VERONA 是一个轻量级 Python 包,用于快速搭建鲁棒性实验并计算鲁棒性分布。它解决了机器学习模型在···
MambaInLlama
开源
把 Llama 蒸馏成混合模型,推理更快更省内存
MambaInLlama 是 NeurIPS 2024 的官方实现,专注于将 Llama 等预训练 Transformer 模型蒸馏为混合架···
align-anything
开源
一套框架搞定全模态对齐训练,省时省力
Align Anything 是一个面向全模态模型的对齐训练框架,旨在解决多模态模型(文本、图像、音频、视频···
VADER
开源
用奖励梯度微调视频模型,让生成结果更合你心意
VADER 是一个用于视频扩散模型对齐的开源项目,通过奖励梯度(Reward Gradients)对预训练的视频生···
Adam-mini
开源
用更少学习率,训更快更大模型,省显存提性能。
Adam-mini 是一个优化器算法项目,旨在通过减少学习率数量来提升模型训练效率。它基于论文《Adam-m···
llm-compressor
开源
一键压缩大模型,vLLM 直接跑,省显存提吞吐
llm-compressor 是 vLLM 团队推出的 LLM 压缩工具库,与 Hugging Face Transformers 无缝兼容。它解···