模型训练

汇聚全球AI模型训练与微调项目,LoRA、全参微调、蒸馏、训练框架工具大全。

共收录 523 个开源项目

NeoHorse 开源

让模型自己出题、自己训练、自己变强

NeoHorse 是一个面向大语言模型后训练(post-training)的开源研究项目,核心思路是通过「智能体式···

★ 920 评分 2026-09-04
EasyWAM 开源

一套代码搞定世界动作模型的训练、微调与评测

EasyWAM 是一个面向具身智能与机器人领域的统一训练框架,专注于 World Action Model(世界动作模型···

★ 339 评分 2026-08-26
halo 开源

一套框架搞定 LLM 与多模态的微调和强化学习训练

Halo 是由 White Circle 开源的大语言与多模态模型训练框架,用 Python 编写。它面向从微调到强化学···

★ 713 评分 2026-08-26
MindPipe 开源

一键压缩大模型,让 LLM 在 NVIDIA 和昇腾上跑得更快更省显存。

MindPipe 是一个面向大语言模型(LLM)和多模态大模型(LVLM)的模型压缩框架,专门适配 NVIDIA GP···

★ 7 评分 2026-08-15
DiffusionOPSD 开源

让扩散模型自我蒸馏,少步采样也能生成高质量图像

DiffusionOPSD 是一个针对扩散模型的在线策略自蒸馏(On-Policy Self-Distillation)训练框架,旨在···

★ 520 评分 2026-07-29
voice_clone_lab 开源

几分钟音频克隆音色,本地微调生成专属语音

voice_clone_lab 是一个基于 Qwen3-TTS 的本地语音克隆工具,用户只需提供几分钟的音频样本,即可微···

★ 151 评分 2026-07-18
J-Wash 开源

可视化模型内部机制,手动微调对齐行为并导出结果

J-Wash 是一个基于 Anthropic Jacobian Lens 技术构建的大语言模型手动对齐工具。它通过分析模型内···

★ 228 评分 2026-07-13
remote-gpu-trainer 开源

远程GPU训练全流程管理,从运行到交付可复现结果

remote-gpu-trainer 是一个面向深度学习实验生命周期的 Agent Skill 工具,旨在解决远程 GPU 训练中···

★ 63 评分 2026-06-18
ts-icl 开源

零样本搞定时间序列预测与插补,无需重新训练。

TS-ICL 是一个基于时间索引的基础模型,专为时间序列预测和插补任务设计,通过上下文学习(In-Cont···

★ 127 评分 2026-06-12
MLX-LoRA-Studio 开源

Mac 上点几下就完成大模型 LoRA 微调,数据不出本机

MLX-LoRA-Studio 是一款原生 macOS 应用,让用户在 Apple Silicon 芯片的 Mac 上直接完成大语言模型···

★ 270 评分 2026-06-11
UniRL 开源

一套框架搞定多种数据训练,强化学习不再各搞各的

腾讯混元开源的统一多模态强化学习框架,支持在多模态场景下训练与优化模型。它提供统一的 RL 流程···

★ 985 评分 2026-06-08
RLCSD 开源

用对比自蒸馏强化 RL 训练,让策略更稳更高效

RLCSD 是论文《RLCSD: Reinforcement Learning with Contrastive On-Policy Self-Distillation》的···

★ 108 评分 2026-06-05
JetSpec 开源

让大模型推理更快:并行草稿树突破推测解码速度天花板

JetSpec 是一个针对推测解码(Speculative Decoding)性能瓶颈的开源项目,核心创新在于提出“因果···

★ 227 评分 2026-05-27
can-i-finetune-this 开源

先查显存再微调,避免模型下载后跑不动的尴尬

这是一个帮助开发者快速判断 Hugging Face 上的模型能否在本地 GPU 上进行微调的工具。它通过分析模···

★ 792 评分 2026-05-16
CDM 开源

少步扩散蒸馏,让图像生成快如闪电

CDM(Continuous-Time Distribution Matching)是一个面向少步扩散蒸馏的开源项目,旨在解决扩散模···

★ 155 评分 2026-05-07
LeapAlign_Code 开源

任意步数生成高质量图像,让流匹配模型又快又好。

LeapAlign 是一个针对流匹配(Flow Matching)图像生成模型的训练后优化方法,核心目标是让模型在任···

★ 58 评分 2026-05-04
how-to-train-your-gpt 开源

手把手从零写GPT,每行代码都讲透

这是一个从零开始构建现代大语言模型(LLM)的教学项目,以Jupyter Notebook形式呈现,每一行代码都···

★ 3364 评分 2026-05-03
minimind-o 开源

从零训练0.1B全模态模型,单卡搞定能听会说能看

MiniMind-O 是一个从零开始训练的 0.1B 参数全模态(Omni)模型,旨在让开发者以极低资源复现类似 ···

★ 2574 评分 2026-05-01
nano-world-model 开源

用扩散强制训练世界模型,让机器人看懂视频并规划动作。

nano-world-model 是一个极简但功能完备的世界模型研究仓库,旨在推进世界模型科学的发展。它基于扩···

★ 741 评分 2026-04-30
AwesomeOPD 开源

一站式速览在线策略蒸馏,紧跟LLM前沿

AwesomeOPD 是一个关于在线策略蒸馏(On-Policy Distillation)的精选资源列表,专注于大语言模型(···

★ 869 评分 2026-04-27
LoongForge 开源

一套框架,NVIDIA 和昆仑芯通吃,搞定大模型全流程训练

LoongForge 是一个面向大模型训练的统一高性能框架,支持在 NVIDIA GPU 和昆仑芯 XPU 上训练 LLM、···

★ 578 评分 2026-04-23
alpamayo-recipes 开源

自动驾驶大模型微调、量化、部署一条龙配方

alpamayo-recipes 是 NVIDIA Alpamayo 的开发者中心,面向自动驾驶与物理 AI 场景,提供一整套可直···

★ 192 评分 2026-04-22
Fizgig 开源

一站式训练、剖析、修复和提取 Krea 2 与 Flux 2 的 LoRA/LoKR

Fizgig 是一个面向 Krea 2 和 Flux 2 Klein 9B 模型的 LoRA 训练与工具集,专注于 LoKR(一种低秩适···

★ 417 评分 2026-04-20
data-forcing-distillation 开源

少步生成视频,不丢多样性和画质

Data-Forcing Distillation (DFD) 是一个用于少步视频生成的蒸馏方法,旨在解决现有蒸馏技术在少步···

★ 59 评分 2026-04-19