KG-FIT
开源
用大模型给知识图谱做微调,让关系预测更准
KG-FIT 是一个针对知识图谱的微调工具,利用大型语言模型(LLMs)来优化知识图谱嵌入。它解决了传统···
汇聚全球AI模型训练与微调项目,LoRA、全参微调、蒸馏、训练框架工具大全。
共收录 524 个开源项目
KG-FIT
开源
用大模型给知识图谱做微调,让关系预测更准
KG-FIT 是一个针对知识图谱的微调工具,利用大型语言模型(LLMs)来优化知识图谱嵌入。它解决了传统···
selfcodealign
开源
让代码模型自己教自己,无需人工标注,自动提升生成质量。
SelfCodeAlign 是一个面向代码生成任务的自对齐框架,核心思想是让模型通过自身生成的数据来提升代···
LLM-SR
开源
用大模型从数据中自动发现科学方程,告别手动推导。
LLM-SR 是一个基于大型语言模型的科学方程发现与符号回归工具,源自 ICLR 2025 Oral 论文。它解决传···
TSLANet
开源
轻量级时间序列全能模型,低算力搞定分类、异常检测等任务
TSLANet 是一个面向时间序列任务的轻量级基础模型,发表于 ICML 2024。它结合卷积操作与自适应频谱···
DoRA
开源
把LoRA拆成幅度和方向,微调效果更准更稳
DoRA(权重分解低秩适配)是ICML 2024口头报告论文的官方PyTorch实现,一种参数高效微调方法。它通···
finetune-SAM
开源
把通用分割模型SAM微调到你的医学图像上,提升精度
finetune-SAM 是官方提供的用于在定制医学图像上微调 SAM(Segment Anything Model)的代码仓库。它···
shortened-llm
开源
压缩LLM,推理提速,显存减半,生成依旧流畅。
shortened-llm 是一个针对大语言模型(LLM)的压缩与高效文本生成工具,源自 ICLR'24 Workshop 的研···
TEMPO
开源
用提示词调教时间序列预测,跨领域泛化更强
TEMPO 是一个基于提示词(prompt)的生成式预训练Transformer模型,专为时间序列预测任务设计,是I···
long-context-attention
开源
把超长上下文注意力切到多卡上,训练推理都能跑更长
long-context-attention 是面向长上下文 Transformer 训练与推理的序列并行注意力实现,核心是 USP···
RLHF-Reward-Modeling
开源
一键训练 RLHF 奖励模型,快速对齐大模型
RLHF-Reward-Modeling 是一个专注于训练 RLHF(基于人类反馈的强化学习)奖励模型的开源项目。它提···
MTP
开源
多任务预训练遥感模型,一个骨干搞定多种任务
MTP 是 JSTARS'24 论文的官方实现,提出了一种面向遥感基础模型的多任务预训练方法。它通过同时学习···
LLM-RLHF-Tuning-with-PPO-and-DPO
开源
一站式跑通大模型 RLHF:SFT 到 PPO/DPO 全流程
这是一个面向大模型对齐训练的完整工具包,围绕人类反馈强化学习(RLHF)流程,覆盖指令微调、奖励···
RAG-Retrieval
开源
统一微调 RAG 检索模型,让召回更精准
RAG-Retrieval 是一个专注于统一 RAG(检索增强生成)检索环节高效微调的开源框架,覆盖 Embedding···
Agent-FLAN
开源
让大模型学会用工具,微调数据与方法一键搞定
Agent-FLAN 是复旦大学等机构在 ACL 2024 Findings 发表的开源项目,核心是解决大语言模型(LLM)在···
SVD-LLM
开源
用SVD给大模型瘦身,压缩后照样能打
SVD-LLM 是一个面向大语言模型的低秩压缩与微调框架,基于奇异值分解(SVD)技术,在保持模型性能的···
sd-lora-trainer
开源
拖入图片,一键训练专属 LoRA,快速定制 SD 模型风格
sd-lora-trainer 是一个用于训练 Stable Diffusion 模型 LoRA 和 embedding 的开源工具,支持 SDXL···
transformer-tricks
开源
查Transformer加速技巧,少走弯路,直接上手
这是一个关于Transformer模型加速技巧与工具的集合仓库,主要面向深度学习工程师和研究者,解决Tra···
TFMQ-DM
开源
给扩散模型瘦身,4-bit量化不降画质,部署提速。
TFMQ-DM 是 CVPR 2024 Highlight 和 TPAMI 2025 论文的官方 PyTorch 实现,专注于扩散模型的训练后···
LightCompress
开源
一套工具压缩 LLM/VLM/视频模型,部署更省资源
LightCompress 是一个面向大模型压缩的开源工具包,由 EMNLP 2024 和 AAAI 2026 论文支撑,支持对 ···
CoDA-NO
开源
用注意力机制快速求解多物理场 PDE,让仿真更高效
CoDA-NO 是一个基于共域注意力神经算子的开源模型,用于解决偏微分方程(PDE)的单物理到多物理自适···
FedKTL
开源
用服务端预训练生成器,让异构联邦学习上传更少、效果更好。
FedKTL 是一个面向异构联邦学习的知识迁移框架,核心解决在客户端数据分布不均、算力差异大的场景下···
llamaduo
开源
把大模型能力搬回家,低成本打造专属小模型
LlamaDuo 是一个面向 LLMOps 的流水线框架,旨在帮助用户从商业大模型(如 GPT-4)无缝迁移到小规模···
TCD
开源
少步采样,快速出图,扩散模型提速神器
TCD(Trajectory Consistency Distillation)是一个用于加速扩散模型采样的训练方法,源自同名论文···
ETO
开源
让 LLM Agent 在试错中自我进化,越用越聪明
ETO 是一个面向 LLM Agent 的轨迹优化框架,基于试错探索机制,通过让智能体在环境中主动尝试、犯错···