模型训练

汇聚全球AI模型训练与微调项目,LoRA、全参微调、蒸馏、训练框架工具大全。

共收录 524 个开源项目

modalities 开源

PyTorch 原生分布式训练,配置化复现大模型实验

Modalities 是一个基于 PyTorch 原生构建的基础模型训练框架,目标是把分布式训练和可复现性做成开···

★ 111 评分 2024-01-11
INTERS 开源

给大模型注入搜索能力,让检索结果更精准

INTERS 是一个面向搜索场景的大语言模型指令微调开源项目,源自同名论文。它旨在解决通用大模型在信···

★ 208 评分 2024-01-05
create-stable-diffusion-from-scratch 开源

手写Stable Diffusion核心代码,从零看懂扩散模型

这是一个从零开始实现稳定扩散(Stable Diffusion)架构的教程型开源项目,基于PyTorch编写,以Jup···

★ 91 评分 2024-01-02
transformerlab-app 开源

一站式搞定大模型训练、微调和评估,从笔记本到集群无缝扩展

Transformer Lab 是一个面向 AI 研究者的开源研究环境,旨在让模型训练、评估和扩展变得无缝流畅,···

★ 5192 评分 2023-12-24
MoTCoder 开源

把复杂编程题拆成小模块,让大模型推理更准

MoTCoder 是一个开源项目,旨在通过“模块化思维”(Modular of Thought)提升大型语言模型在复杂编···

★ 86 评分 2023-12-23
AAAI2025_MIA-Tuner 开源

一句话识别文本是否来自模型预训练数据,助力隐私审计。

MIA-Tuner 是一个针对大语言模型的预训练文本检测器,核心任务是判断一段文本是否来自模型的预训练···

★ 130 评分 2023-12-20
Adaptive-MT-LLM-Fine-tuning 开源

微调开源大模型,让翻译更懂你的领域

Adaptive-MT-LLM-Fine-tuning 是一个针对开源大语言模型进行自适应机器翻译微调的开源项目。它解决···

★ 89 评分 2023-12-19
codebase-for-incremental-learning-wi··· 开源

让大模型学新知识不忘旧技能,复现ACL论文的增量学习工具箱

这是一个用于大语言模型增量学习的开源代码库,由ACL 2024相关论文官方发布,包含三篇工作的实现:···

★ 63 评分 2023-12-13
EAGLE 开源

让大模型生成速度翻倍,无需牺牲输出质量

EAGLE是一个开源的大语言模型推理加速框架,由字节跳动团队开发,包含EAGLE-1、EAGLE-2和EAGLE-3三···

★ 2542 评分 2023-12-07
DiffuseKronA 开源

用更少参数微调扩散模型,生成更精准的个性化图像

DiffuseKronA 是一种面向个性化扩散模型的参数高效微调方法。它针对文本到图像生成中,用户希望用少···

★ 131 评分 2023-12-06
TorchCP 开源

给深度学习预测加上可证明的可靠性边界,一行代码搞定不确定性量化。

TorchCP 是一个基于 PyTorch 的保形预测(Conformal Prediction)研究工具箱,专为深度学习模型设计···

★ 479 评分 2023-12-06
unsloth 开源

本地一键跑起最新大模型,调教它不花一分钱

本地运行与训练文本、扩散模型的 UI 工具,支持 Kimi、Gemma、Qwen3.6、DeepSeek-V4、FLUX 等最新模···

★ 76825 评分 2023-11-29
RLHF-V 开源

用细粒度人类纠错对齐模型行为,大幅减少视觉幻觉。

RLHF-V 是一个面向多模态大语言模型(MLLMs)的可信行为对齐框架,核心解决模型在视觉对话中产生幻···

★ 311 评分 2023-11-29
DDSM 开源

让扩散模型训练更快更省,按步骤智能分配学习资源

DDSM(Denoising Diffusion Step-aware Models)是ICLR 2024收录的扩散模型训练优化方法。它针对扩···

★ 62 评分 2023-11-29
SwanLab 开源

一键跟踪训练指标,可视化对比实验,加速模型迭代

SwanLab 是一个开源、现代设计的 AI 训练跟踪与可视化工具,支持云端和自托管两种使用方式。它解决···

★ 4228 评分 2023-11-24
maestro 开源

一行命令微调多模态模型,快速搞定视觉语言任务

Maestro 是一个专注于多模态模型微调的开源工具,旨在简化 PaliGemma 2、Florence-2 和 Qwen2.5-VL···

★ 2696 评分 2023-11-24
reevo 开源

让大模型自动进化出高效启发式规则,解决优化难题

ReEvo 是一个基于大语言模型的超启发式算法(Hyper-Heuristics)框架,发表于 NeurIPS 2024。它旨在···

★ 302 评分 2023-11-20
self-llm 开源

手把手教你微调部署开源大模型,中文教程一步到位

self-llm 是一个面向中文用户的开源大模型教程项目,旨在帮助开发者快速上手国内外开源大模型(LLM···

★ 32330 评分 2023-11-16
HALC 开源

减少多模态模型幻觉,让AI描述更可信

HALC 是一个针对多模态大语言模型(如 LLaVA)的物体幻觉抑制工具,基于 ICML 2024 论文实现。它通···

★ 116 评分 2023-11-03
awesome-llms-fine-tuning 开源

一站式收藏LLM微调资源,从入门到进阶少走弯路

这是一个关于大语言模型微调的精选资源列表,汇集了教程、论文、工具和最佳实践。它旨在帮助机器学···

★ 528 评分 2023-10-30
deita 开源

用更少的高质量数据,训出更强的对齐模型

Deita 是一个专注于数据高效指令微调的开源项目,旨在解决大语言模型对齐过程中数据质量参差不齐、···

★ 603 评分 2023-10-26
LLM-FineTuning-Large-Language-Models 开源

跟着 Notebook 一步步学会大模型微调

该项目是一个专注于大语言模型(LLM)微调的教学型开源仓库,主要使用 Jupyter Notebook 编写,旨在···

★ 578 评分 2023-10-22
raft 开源

微调+RAG双阶段,让AI代理精准模仿特定人物

RAFT(Retrieval-Augmented Fine-Tuning)是一个结合检索增强生成(RAG)与微调的开源方法库,旨在···

★ 176 评分 2023-10-20
lorax 开源

一个服务跑上千个微调模型,省 GPU 又省心

Lorax 是一个专为大规模多 LoRA 推理而设计的高性能服务器,能够同时承载数千个微调后的 LLM。它解···

★ 3834 评分 2023-10-20