模型训练

汇聚全球AI模型训练与微调项目,LoRA、全参微调、蒸馏、训练框架工具大全。

共收录 524 个开源项目

KG-FIT 开源

用大模型给知识图谱做微调,让关系预测更准

KG-FIT 是一个针对知识图谱的微调工具,利用大型语言模型(LLMs)来优化知识图谱嵌入。它解决了传统···

★ 130 评分 2024-04-30
selfcodealign 开源

让代码模型自己教自己,无需人工标注,自动提升生成质量。

SelfCodeAlign 是一个面向代码生成任务的自对齐框架,核心思想是让模型通过自身生成的数据来提升代···

★ 325 评分 2024-04-25
LLM-SR 开源

用大模型从数据中自动发现科学方程,告别手动推导。

LLM-SR 是一个基于大型语言模型的科学方程发现与符号回归工具,源自 ICLR 2025 Oral 论文。它解决传···

★ 273 评分 2024-04-19
TSLANet 开源

轻量级时间序列全能模型,低算力搞定分类、异常检测等任务

TSLANet 是一个面向时间序列任务的轻量级基础模型,发表于 ICML 2024。它结合卷积操作与自适应频谱···

★ 267 评分 2024-04-12
DoRA 开源

把LoRA拆成幅度和方向,微调效果更准更稳

DoRA(权重分解低秩适配)是ICML 2024口头报告论文的官方PyTorch实现,一种参数高效微调方法。它通···

★ 1000 评分 2024-04-11
finetune-SAM 开源

把通用分割模型SAM微调到你的医学图像上,提升精度

finetune-SAM 是官方提供的用于在定制医学图像上微调 SAM(Segment Anything Model)的代码仓库。它···

★ 279 评分 2024-04-09
shortened-llm 开源

压缩LLM,推理提速,显存减半,生成依旧流畅。

shortened-llm 是一个针对大语言模型(LLM)的压缩与高效文本生成工具,源自 ICLR'24 Workshop 的研···

★ 91 评分 2024-04-01
TEMPO 开源

用提示词调教时间序列预测,跨领域泛化更强

TEMPO 是一个基于提示词(prompt)的生成式预训练Transformer模型,专为时间序列预测任务设计,是I···

★ 142 评分 2024-04-01
long-context-attention 开源

把超长上下文注意力切到多卡上,训练推理都能跑更长

long-context-attention 是面向长上下文 Transformer 训练与推理的序列并行注意力实现,核心是 USP···

★ 695 评分 2024-03-27
RLHF-Reward-Modeling 开源

一键训练 RLHF 奖励模型,快速对齐大模型

RLHF-Reward-Modeling 是一个专注于训练 RLHF(基于人类反馈的强化学习)奖励模型的开源项目。它提···

★ 1546 评分 2024-03-21
MTP 开源

多任务预训练遥感模型,一个骨干搞定多种任务

MTP 是 JSTARS'24 论文的官方实现,提出了一种面向遥感基础模型的多任务预训练方法。它通过同时学习···

★ 253 评分 2024-03-18
LLM-RLHF-Tuning-with-PPO-and-DPO 开源

一站式跑通大模型 RLHF:SFT 到 PPO/DPO 全流程

这是一个面向大模型对齐训练的完整工具包,围绕人类反馈强化学习(RLHF)流程,覆盖指令微调、奖励···

★ 194 评分 2024-03-18
RAG-Retrieval 开源

统一微调 RAG 检索模型,让召回更精准

RAG-Retrieval 是一个专注于统一 RAG(检索增强生成)检索环节高效微调的开源框架,覆盖 Embedding···

★ 1131 评分 2024-03-16
Agent-FLAN 开源

让大模型学会用工具,微调数据与方法一键搞定

Agent-FLAN 是复旦大学等机构在 ACL 2024 Findings 发表的开源项目,核心是解决大语言模型(LLM)在···

★ 362 评分 2024-03-15
SVD-LLM 开源

用SVD给大模型瘦身,压缩后照样能打

SVD-LLM 是一个面向大语言模型的低秩压缩与微调框架,基于奇异值分解(SVD)技术,在保持模型性能的···

★ 307 评分 2024-03-13
sd-lora-trainer 开源

拖入图片,一键训练专属 LoRA,快速定制 SD 模型风格

sd-lora-trainer 是一个用于训练 Stable Diffusion 模型 LoRA 和 embedding 的开源工具,支持 SDXL···

★ 70 评分 2024-03-11
transformer-tricks 开源

查Transformer加速技巧,少走弯路,直接上手

这是一个关于Transformer模型加速技巧与工具的集合仓库,主要面向深度学习工程师和研究者,解决Tra···

★ 229 评分 2024-03-11
TFMQ-DM 开源

给扩散模型瘦身,4-bit量化不降画质,部署提速。

TFMQ-DM 是 CVPR 2024 Highlight 和 TPAMI 2025 论文的官方 PyTorch 实现,专注于扩散模型的训练后···

★ 110 评分 2024-03-09
LightCompress 开源

一套工具压缩 LLM/VLM/视频模型,部署更省资源

LightCompress 是一个面向大模型压缩的开源工具包,由 EMNLP 2024 和 AAAI 2026 论文支撑,支持对 ···

★ 749 评分 2024-03-06
CoDA-NO 开源

用注意力机制快速求解多物理场 PDE,让仿真更高效

CoDA-NO 是一个基于共域注意力神经算子的开源模型,用于解决偏微分方程(PDE)的单物理到多物理自适···

★ 78 评分 2024-03-06
FedKTL 开源

用服务端预训练生成器,让异构联邦学习上传更少、效果更好。

FedKTL 是一个面向异构联邦学习的知识迁移框架,核心解决在客户端数据分布不均、算力差异大的场景下···

★ 69 评分 2024-03-05
llamaduo 开源

把大模型能力搬回家,低成本打造专属小模型

LlamaDuo 是一个面向 LLMOps 的流水线框架,旨在帮助用户从商业大模型(如 GPT-4)无缝迁移到小规模···

★ 317 评分 2024-03-04
TCD 开源

少步采样,快速出图,扩散模型提速神器

TCD(Trajectory Consistency Distillation)是一个用于加速扩散模型采样的训练方法,源自同名论文···

★ 361 评分 2024-02-29
ETO 开源

让 LLM Agent 在试错中自我进化,越用越聪明

ETO 是一个面向 LLM Agent 的轨迹优化框架,基于试错探索机制,通过让智能体在环境中主动尝试、犯错···

★ 169 评分 2024-02-28