模型训练

汇聚全球AI模型训练与微调项目,LoRA、全参微调、蒸馏、训练框架工具大全。

共收录 524 个开源项目

MirrorMetrics 开源

用 InsightFace 人脸识别,直观诊断 LoRA 过拟合与数据质量。

MirrorMetrics 是一个针对 Stable Diffusion LoRA 训练的可视化诊断工具,利用 InsightFace 人脸识···

★ 62 评分 2026-02-15
m-courtyard 开源

在 Mac 上零代码微调 AI 模型,数据不出本机。

M-Courtyard 是一款专为 Apple Silicon 芯片打造的本地 AI 模型微调桌面工具。它基于 Tauri、React···

★ 174 评分 2026-02-12
doc-to-lora 开源

让大模型随时记住新知识,不用重训

doc-to-lora 是一个让大语言模型通过超网络(Hypernetworks)动态生成 LoRA 权重来记住事实信息的开···

★ 826 评分 2026-02-11
GeoPT 开源

用几何预训练,让物理仿真又快又准

GeoPT 是一个面向物理仿真的预训练模型框架,其核心思路是通过“提升几何预训练”技术,让模型在无···

★ 263 评分 2026-02-09
strands-env 开源

快速搭建智能体强化学习训练环境,直接对接 Strands Agents。

strands-env 是一个用于构建智能体环境的框架,专为 Strands Agents 的强化学习训练与评估而设计。···

★ 62 评分 2026-01-30
FreeFuse 开源

测试时动态路由,多 LoRA 融合不打架

FreeFuse 是一个用于多主体 LoRA 融合的图像生成工具,解决在测试时(推理阶段)将多个 LoRA 模型动···

★ 243 评分 2026-01-29
residual-context-diffusion 开源

把丢弃的信号变成推理先验,让扩散大模型更聪明

Residual Context Diffusion (RCD) 是一个面向扩散式大语言模型(dLLMs)的高性能推理增强框架,发···

★ 61 评分 2026-01-29
meta-context-engineering 开源

让AI自动进化上下文策略,告别手写提示词

Meta Context Engineering 是一个面向大语言模型上下文工程的研究项目,核心思路是通过智能体技能进···

★ 171 评分 2026-01-29
Aurora 开源

统一多模态时间序列预测,一个模型搞定数值文本图像

Aurora 是一个面向通用多模态时间序列预测的开源模型,由 ICLR 2026 论文提出。它旨在解决传统时间···

★ 79 评分 2026-01-27
DART 开源

扩散式推测解码,让大模型推理更快更省算力

DART 是一个旨在加速大语言模型推理的推测解码(Speculative Decoding)方法的官方实现。它受扩散模···

★ 71 评分 2026-01-26
burn-onnx 开源

把 ONNX 模型转成纯 Rust Burn 代码,推理微调不再依赖 Python

burn-onnx 是一个把 ONNX 模型转换为 Burn 框架原生 Rust 代码的工具,目标是让训练好的模型脱离 P···

★ 134 评分 2026-01-26
TinyEngram 开源

给大模型装上长期记忆,让对话和生成更连贯

TinyEngram 是一个基于 Qwen-3 和 Stable Diffusion 系列模型的研究项目,旨在复现并验证 DeepSeek···

★ 1378 评分 2026-01-23
EvoControl 开源

让AI自己优化代码,还能按你的要求来

EvoControl 是一个用于算法代码优化的受控自进化框架的官方实现。它解决的是大语言模型在代码优化任···

★ 134 评分 2026-01-08
sklearn-diagnose 开源

给 sklearn 模型做 AI 体检,一眼揪出过拟合和数据泄漏

sklearn-diagnose 是一个面向 Scikit-learn 模型的 AI 诊断工具,旨在帮助数据科学家快速识别模型训···

★ 62 评分 2026-01-07
mlx-tune 开源

在 Mac 上本地微调大模型,多模态全支持,速度飞快

mlx-tune 是一个专为 Apple Silicon Mac 设计的 LLM 微调工具,基于 MLX 框架原生运行,让开发者无···

★ 1413 评分 2026-01-03
surogate 开源

用 C++ 和 CUDA 把大模型微调速度拉到极致

surogate 是一个专注于大语言模型训练与微调的高性能开源项目,基于 C++ 和 CUDA 实现,旨在提供“···

★ 821 评分 2026-01-02
deep-delta-learning 开源

学增量,少训练,模型升级快人一步

Deep Delta Learning 是一个开源模型项目,源自 arXiv 论文,旨在通过深度学习方法学习数据或模型之···

★ 363 评分 2026-01-01
MHLA 开源

用 token 级多头,让线性注意力恢复全量表达力

MHLA 是一个面向图像生成与语言建模的线性注意力机制改进项目,旨在解决线性注意力在表达力上的不足···

★ 157 评分 2025-12-28
lora-pilot 开源

一键启动 Docker,搞定 LoRA 训练与验证全流程

lora-pilot 是一个面向 Stable Diffusion 生态的一体化 Docker 镜像,旨在简化 LoRA 模型的训练与验···

★ 80 评分 2025-12-26
LightRFT 开源

用奖励模型驱动微调,让 LLM/VLM 按目标越训越强

LightRFT 是一个轻量、高效、支持全模态的强化微调(RFT)框架,核心思路是用奖励模型驱动训练,把···

★ 404 评分 2025-12-23
Flow-Factory 开源

让流匹配模型轻松学会强化学习,生成更符合目标的结果

Flow-Factory 是一个面向 Flow-Matching 模型的统一强化学习框架,旨在简化基于流匹配的生成模型(···

★ 707 评分 2025-12-18
SteptronOss 开源

一套配置跑通大模型微调、强化与评测

SteptronOss 是一个面向大语言模型的轻量级、AI 原生训练框架,目标是把 SFT(监督微调)、RLVR(可···

★ 587 评分 2025-12-18
GRAPE 开源

给图神经网络装上更强的位置编码,提升结构感知能力。

GRAPE 是一个面向图神经网络的表示位置编码方法,由 ICLR 2026 论文提出。它通过将节点分组并学习组···

★ 120 评分 2025-12-08
comfyUI-Realtime-Lora 开源

在 ComfyUI 里直接训练、编辑和保存 LoRA,无需切换工具

这是一个 ComfyUI 的插件,让你直接在 ComfyUI 界面里训练、编辑和保存 LoRA 模型,无需切换到外部···

★ 562 评分 2025-12-05