模型训练

汇聚全球AI模型训练与微调项目,LoRA、全参微调、蒸馏、训练框架工具大全。

共收录 524 个开源项目

tirex 开源

零样本预测长短周期,无需训练直接上手

TiRex 是一个面向时间序列预测的开源模型,主打零样本(Zero-Shot)跨长短周期预测,并强化了上下文···

★ 304 评分 2025-05-27
RPG 开源

给大模型 RL 训练加上安全护栏,稳定提升性能

RPG 是一个基于 KL 正则化策略梯度的强化学习训练框架,源自 ICLR 2026 论文。它旨在解决大语言模型···

★ 78 评分 2025-05-26
LongCodeZip 开源

压缩长代码上下文,让模型轻松处理超长代码

LongCodeZip 是一个面向代码语言模型的长上下文压缩工具,源自 ASE 2025 论文。它解决的是代码大模···

★ 168 评分 2025-05-26
TreeLoRA 开源

用树状 LoRA 分层管理任务,持续学习不遗忘

TreeLoRA 是 ICML 2025 论文的 PyTorch 实现,面向持续学习(Continual Learning)场景,提出一种基···

★ 350 评分 2025-05-24
HoliTom 开源

合并视频令牌,让视频大模型推理快数倍

HoliTom是一个针对视频大语言模型(Video LLM)的推理加速工具,核心思路是“整体令牌合并”(Holi···

★ 86 评分 2025-05-23
VeriThinker 开源

让模型学会自我验证,推理更快更准

VeriThinker 是一个基于 NeurIPS 2025 论文的开源推理模型,旨在通过引入验证机制来提升大语言模型···

★ 68 评分 2025-05-22
Complete-LLM-Finetuning 开源

跟着 Notebook 跑一遍,就能亲手微调大模型

Complete-LLM-Finetuning 是一个以 Jupyter Notebook 形式呈现的大语言模型微调全流程教程项目,目···

★ 228 评分 2025-05-22
Scaling-Diffusion-Transformers-muP 开源

让扩散模型从小规模到大规模训练,超参数无需重调,省时省力。

Scaling-Diffusion-Transformers-muP 是 NeurIPS 2025 论文的官方实现,旨在解决扩散 Transformer(···

★ 100 评分 2025-05-21
Automodel 开源

Hugging Face 模型直接多卡分布式微调,不改代码。

Automodel 是一个基于 PyTorch 分布式原生的 LLM/VLM 训练库,目标是让大模型微调像调用 Hugging F···

★ 978 评分 2025-05-21
verbalized-sampling 开源

让LLM输出带概率的多样答案,告别重复文本

Verbalized Sampling 是一个无需训练的提示词策略框架,旨在通过让大语言模型以概率形式输出候选答···

★ 812 评分 2025-05-20
BitVAE 开源

用比特级分词,让图像生成更精细高效

BitVAE 是一个图像分词器(tokenizer)的官方训练与推理代码库,属于自回归图像生成模型的基础组件···

★ 72 评分 2025-05-18
RLVR-World 开源

用强化学习训练能用于决策的视频生成世界模型

RLVR-World 是 NeurIPS 2025 论文《Training World Models with Reinforcement Learning》的官方实···

★ 277 评分 2025-05-17
Time-R1 开源

让大模型像专家一样一步步推理预测时间序列

Time-R1 是一个两阶段强化微调框架,用于训练大语言模型进行慢思考、逐步推理,以实现准确且可解释···

★ 100 评分 2025-05-15
Time-R1 开源

用三阶段强化学习,让大模型真正理解时间、预测未来。

Time-R1 是一个旨在赋予大语言模型(LLM)全面时间推理能力的开源框架和资源集合。它解决的是当前 ···

★ 71 评分 2025-05-15
ParScale 开源

并行跑多个模型,不堆参数也能提升性能

ParScale 是一个研究并行扩展定律(Parallel Scaling Law)的开源项目,旨在突破传统语言模型仅依赖···

★ 486 评分 2025-05-15
GuidedQuant 开源

用端到端损失引导量化,让大模型压缩后不掉点

GuidedQuant 是 ICML 2025 论文的官方 PyTorch 实现,提出一种利用端到端损失引导的大语言模型量化···

★ 57 评分 2025-05-11
mlx-lm-lora 开源

Mac 上微调大模型,LoRA/DPO 一条命令跑通

mlx-lm-lora 是面向 Apple Silicon 的 LLM 训练工具,基于苹果 MLX 框架,让 Mac 用户无需 NVIDIA ···

★ 418 评分 2025-05-10
SkyRL 开源

把 LLM 强化学习全流程拆成乐高,多轮工具任务也能直接训

SkyRL 是一个面向大语言模型的模块化全栈强化学习库,目标是把 RL 训练 LLM 所需的各个环节——环境···

★ 2349 评分 2025-04-22
onebitllms 开源

小显存也能训练1.58bit三值大模型

onebitllms 是一个轻量级 Python 工具包,专注于训练和微调 1.58bit 量化语言模型。传统大模型动辄···

★ 149 评分 2025-04-16
lightly-train 开源

一个命令搞定视觉模型预训练、微调和蒸馏,告别碎片化流程。

lightly-train 是一个面向视觉模型的一体化训练框架,支持 YOLO、ViT、RT-DETR、DINOv3 等主流架构···

★ 1688 评分 2025-04-10
d1 开源

用强化学习给扩散大模型补上推理能力

d1 是论文《d1: Scaling Reasoning in Diffusion Large Language Models via Reinforcement Learni···

★ 457 评分 2025-04-10
LoRI 开源

多任务微调不打架,LoRA 参数更高效

LoRI 是一个针对多任务低秩适配(LoRA)的改进方法,旨在解决多任务学习中的跨任务干扰问题。它通过···

★ 174 评分 2025-04-09
Trinity-RFT 开源

搭好LLM强化微调流水线,换算法扩规模不用重写

Trinity-RFT 是一个面向大语言模型强化微调(RFT)的通用框架,目标是把 RLHF/RFT 从单机脚本式实验···

★ 703 评分 2025-04-09
tunix 开源

用 JAX 搭积木做 LLM 后训练,算法随便换

Tunix 是 Google 开源的一个轻量级大模型后训练(post-training)库,基于 JAX 生态构建,专注于在···

★ 2461 评分 2025-04-02