NeoHorse
开源
让模型自己出题、自己训练、自己变强
NeoHorse 是一个面向大语言模型后训练(post-training)的开源研究项目,核心思路是通过「智能体式···
汇聚全球AI模型训练与微调项目,LoRA、全参微调、蒸馏、训练框架工具大全。
共收录 523 个开源项目
NeoHorse
开源
让模型自己出题、自己训练、自己变强
NeoHorse 是一个面向大语言模型后训练(post-training)的开源研究项目,核心思路是通过「智能体式···
EasyWAM
开源
一套代码搞定世界动作模型的训练、微调与评测
EasyWAM 是一个面向具身智能与机器人领域的统一训练框架,专注于 World Action Model(世界动作模型···
halo
开源
一套框架搞定 LLM 与多模态的微调和强化学习训练
Halo 是由 White Circle 开源的大语言与多模态模型训练框架,用 Python 编写。它面向从微调到强化学···
MindPipe
开源
一键压缩大模型,让 LLM 在 NVIDIA 和昇腾上跑得更快更省显存。
MindPipe 是一个面向大语言模型(LLM)和多模态大模型(LVLM)的模型压缩框架,专门适配 NVIDIA GP···
DiffusionOPSD
开源
让扩散模型自我蒸馏,少步采样也能生成高质量图像
DiffusionOPSD 是一个针对扩散模型的在线策略自蒸馏(On-Policy Self-Distillation)训练框架,旨在···
voice_clone_lab
开源
几分钟音频克隆音色,本地微调生成专属语音
voice_clone_lab 是一个基于 Qwen3-TTS 的本地语音克隆工具,用户只需提供几分钟的音频样本,即可微···
J-Wash
开源
可视化模型内部机制,手动微调对齐行为并导出结果
J-Wash 是一个基于 Anthropic Jacobian Lens 技术构建的大语言模型手动对齐工具。它通过分析模型内···
remote-gpu-trainer
开源
远程GPU训练全流程管理,从运行到交付可复现结果
remote-gpu-trainer 是一个面向深度学习实验生命周期的 Agent Skill 工具,旨在解决远程 GPU 训练中···
ts-icl
开源
零样本搞定时间序列预测与插补,无需重新训练。
TS-ICL 是一个基于时间索引的基础模型,专为时间序列预测和插补任务设计,通过上下文学习(In-Cont···
MLX-LoRA-Studio
开源
Mac 上点几下就完成大模型 LoRA 微调,数据不出本机
MLX-LoRA-Studio 是一款原生 macOS 应用,让用户在 Apple Silicon 芯片的 Mac 上直接完成大语言模型···
UniRL
开源
一套框架搞定多种数据训练,强化学习不再各搞各的
腾讯混元开源的统一多模态强化学习框架,支持在多模态场景下训练与优化模型。它提供统一的 RL 流程···
RLCSD
开源
用对比自蒸馏强化 RL 训练,让策略更稳更高效
RLCSD 是论文《RLCSD: Reinforcement Learning with Contrastive On-Policy Self-Distillation》的···
JetSpec
开源
让大模型推理更快:并行草稿树突破推测解码速度天花板
JetSpec 是一个针对推测解码(Speculative Decoding)性能瓶颈的开源项目,核心创新在于提出“因果···
can-i-finetune-this
开源
先查显存再微调,避免模型下载后跑不动的尴尬
这是一个帮助开发者快速判断 Hugging Face 上的模型能否在本地 GPU 上进行微调的工具。它通过分析模···
CDM
开源
少步扩散蒸馏,让图像生成快如闪电
CDM(Continuous-Time Distribution Matching)是一个面向少步扩散蒸馏的开源项目,旨在解决扩散模···
LeapAlign_Code
开源
任意步数生成高质量图像,让流匹配模型又快又好。
LeapAlign 是一个针对流匹配(Flow Matching)图像生成模型的训练后优化方法,核心目标是让模型在任···
how-to-train-your-gpt
开源
手把手从零写GPT,每行代码都讲透
这是一个从零开始构建现代大语言模型(LLM)的教学项目,以Jupyter Notebook形式呈现,每一行代码都···
minimind-o
开源
从零训练0.1B全模态模型,单卡搞定能听会说能看
MiniMind-O 是一个从零开始训练的 0.1B 参数全模态(Omni)模型,旨在让开发者以极低资源复现类似 ···
nano-world-model
开源
用扩散强制训练世界模型,让机器人看懂视频并规划动作。
nano-world-model 是一个极简但功能完备的世界模型研究仓库,旨在推进世界模型科学的发展。它基于扩···
AwesomeOPD
开源
一站式速览在线策略蒸馏,紧跟LLM前沿
AwesomeOPD 是一个关于在线策略蒸馏(On-Policy Distillation)的精选资源列表,专注于大语言模型(···
LoongForge
开源
一套框架,NVIDIA 和昆仑芯通吃,搞定大模型全流程训练
LoongForge 是一个面向大模型训练的统一高性能框架,支持在 NVIDIA GPU 和昆仑芯 XPU 上训练 LLM、···
alpamayo-recipes
开源
自动驾驶大模型微调、量化、部署一条龙配方
alpamayo-recipes 是 NVIDIA Alpamayo 的开发者中心,面向自动驾驶与物理 AI 场景,提供一整套可直···
Fizgig
开源
一站式训练、剖析、修复和提取 Krea 2 与 Flux 2 的 LoRA/LoKR
Fizgig 是一个面向 Krea 2 和 Flux 2 Klein 9B 模型的 LoRA 训练与工具集,专注于 LoKR(一种低秩适···
data-forcing-distillation
开源
少步生成视频,不丢多样性和画质
Data-Forcing Distillation (DFD) 是一个用于少步视频生成的蒸馏方法,旨在解决现有蒸馏技术在少步···