模型训练

汇聚全球AI模型训练与微调项目,LoRA、全参微调、蒸馏、训练框架工具大全。

共收录 524 个开源项目

jax-llm-examples 开源

纯JAX极简代码,跑通LLM训练与推理

jax-llm-examples 是一个用纯 JAX 实现的极简大语言模型示例集合,目标是让开发者以最少依赖理解并···

★ 284 评分 2025-02-06
Satori 开源

用强化学习让大模型学会自主搜索推理路径,提升复杂问题解决能力

Satori是一个基于强化学习的开源模型,旨在通过链式动作思维(Chain-of-Action-Thought)增强大语言···

★ 114 评分 2025-02-04
Confucius-tool-learning 开源

让大模型通过自我反思学会用工具,从易到难逐步精通

Confucius 是一个面向大语言模型(LLM)的工具学习框架,源自 AAAI 2024 论文。它解决的核心问题是···

★ 151 评分 2025-02-03
rllm 开源

让LLM强化学习训练像搭积木一样简单,快速提升模型推理能力。

rllm是一个致力于将强化学习(RL)技术普及到大型语言模型(LLM)训练与推理中的开源框架。它主要解···

★ 5840 评分 2025-01-26
reasoning-gym 开源

给AI推理训练提供可验证奖励的现成环境,直接上手RL

reasoning-gym 是一个为强化学习(RL)提供可验证奖励(verifiable rewards)的推理环境集合,旨在···

★ 1515 评分 2025-01-23
OntoTune 开源

用本体知识给大模型开小灶,让专业回答更靠谱

OntoTune 是一个面向大语言模型(LLM)的本体驱动自训练框架,旨在解决模型与领域知识对齐不足的问···

★ 50 评分 2025-01-23
BloomBee 开源

多台普通设备拼起来,也能微调和跑大模型

BloomBee 是一个面向大语言模型(LLM)的去中心化微调与推理框架,核心思路是把模型训练和推理任务···

★ 131 评分 2025-01-23
Awesome-Parameter-Efficient-Fine-Tun··· 开源

大模型轻量微调方法一网打尽,选型不再翻论文

这是一个围绕基础模型参数高效微调(PEFT)的资源汇总项目,系统整理了在不大幅增加可训练参数的前···

★ 111 评分 2025-01-23
PSEC 开源

让AI智能体像搭积木一样,在参数空间里不断学习新技能、组合旧技能,应对新挑战。

PSEC是一个面向智能体(Agent)的技能扩展与组合框架,其核心思想是在参数空间中实现技能的动态扩展···

★ 67 评分 2025-01-22
verifiers 开源

一套接口搞定 RL 训练环境与评测

verifiers 是 Prime Intellect 开源的强化学习环境与评测库,面向大模型后训练(RLHF/RLVR)场景。···

★ 4651 评分 2025-01-22
awesome-activation-engineering 开源

整理激活工程资源,助你精准操控AI模型行为

这是一个精选资源列表,专注于“激活工程”(Activation Engineering)领域,即通过修改神经网络内···

★ 141 评分 2025-01-20
finetuning-notebooks 开源

跟着 Notebook 一步步微调图像视频生成模型

finetuning-notebooks 是一个专注于图像与视频生成模型微调的开源教程集合,以 Jupyter Notebook 形···

★ 94 评分 2025-01-16
olmoearth_pretrain 开源

用卫星数据预训练地球基础模型,开箱即用

olmoearth_pretrain 是 Allen AI 推出的地球系统基础模型预训练项目,提供从数据准备、模型训练到评···

★ 313 评分 2025-01-13
train-llm-from-scratch 开源

从数据到生成,手把手教你训练自己的大模型

这是一个从零开始训练大型语言模型(LLM)的完整教程与工具集,旨在帮助开发者理解并实践LLM训练的···

★ 11203 评分 2025-01-12
adaptive-classifier 开源

让文本分类模型随新数据自动进化,无需频繁重训

adaptive-classifier 是一个基于 Python 的灵活自适应文本分类系统,专为处理动态变化的文本分类任···

★ 572 评分 2025-01-12
TPA 开源

把注意力复杂度从平方降到线性,长序列不再卡顿

TPA(Tensor ProducT ATTenTion)是一个NeurIPS 2025 Spotlight论文的开源实现,提出了一种新型注意···

★ 463 评分 2025-01-10
ArcticTraining 开源

配置即跑通 LLM 后训练,省去搭管线的时间

ArcticTraining 是 Snowflake 开源的 LLM 后训练框架,目标是简化和加速大语言模型的微调、对齐与强···

★ 292 评分 2025-01-10
LLaSA_training 开源

用LLM算力换自然语音,训练推理双扩展

LLaSA是一个基于LLaMA架构的语音合成项目,旨在通过扩展训练和推理时的计算量来提升语音生成质量。···

★ 657 评分 2025-01-08
easevoice-trainer 开源

简单几步,训练你的专属语音克隆模型

EaseVoice Trainer 是一个面向普通用户的语音克隆与语音合成模型训练工具。它旨在降低语音模型训练···

★ 350 评分 2025-01-07
flame 开源

极简框架,快速训练线性注意力大模型

flame 是一个极简的深度学习训练框架,专为扩展 FLA(Fast Linear Attention)模型而设计。它解决了···

★ 417 评分 2025-01-06
flow-matching 开源

用流匹配快速训练图像生成模型,替代扩散模型

flow-matching 是一个基于 PyTorch 实现的流匹配(Flow Matching)开源项目,专注于图像生成任务。···

★ 127 评分 2025-01-05
plexe 开源

一句话描述,自动生成机器学习模型,快速验证想法

plexe 是一个基于提示词(prompt)构建机器学习模型的开源工具,旨在让开发者通过自然语言描述即可···

★ 2645 评分 2025-01-05
PRIME 开源

让大模型学会深度推理,强化学习训练一步到位

PRIME 是一个面向语言模型高级推理的可扩展强化学习(RL)解决方案。它解决了当前大模型在复杂推理···

★ 1872 评分 2024-12-31
RecLM 开源

用自然语言指令微调,让推荐模型更懂你

RecLM 是一个面向推荐系统的指令微调框架,源自 ACL 2025 论文。它通过将推荐任务转化为指令遵循问···

★ 112 评分 2024-12-24