modalities
开源
PyTorch 原生分布式训练,配置化复现大模型实验
Modalities 是一个基于 PyTorch 原生构建的基础模型训练框架,目标是把分布式训练和可复现性做成开···
汇聚全球AI模型训练与微调项目,LoRA、全参微调、蒸馏、训练框架工具大全。
共收录 524 个开源项目
modalities
开源
PyTorch 原生分布式训练,配置化复现大模型实验
Modalities 是一个基于 PyTorch 原生构建的基础模型训练框架,目标是把分布式训练和可复现性做成开···
INTERS
开源
给大模型注入搜索能力,让检索结果更精准
INTERS 是一个面向搜索场景的大语言模型指令微调开源项目,源自同名论文。它旨在解决通用大模型在信···
create-stable-diffusion-from-scratch
开源
手写Stable Diffusion核心代码,从零看懂扩散模型
这是一个从零开始实现稳定扩散(Stable Diffusion)架构的教程型开源项目,基于PyTorch编写,以Jup···
transformerlab-app
开源
一站式搞定大模型训练、微调和评估,从笔记本到集群无缝扩展
Transformer Lab 是一个面向 AI 研究者的开源研究环境,旨在让模型训练、评估和扩展变得无缝流畅,···
MoTCoder
开源
把复杂编程题拆成小模块,让大模型推理更准
MoTCoder 是一个开源项目,旨在通过“模块化思维”(Modular of Thought)提升大型语言模型在复杂编···
AAAI2025_MIA-Tuner
开源
一句话识别文本是否来自模型预训练数据,助力隐私审计。
MIA-Tuner 是一个针对大语言模型的预训练文本检测器,核心任务是判断一段文本是否来自模型的预训练···
Adaptive-MT-LLM-Fine-tuning
开源
微调开源大模型,让翻译更懂你的领域
Adaptive-MT-LLM-Fine-tuning 是一个针对开源大语言模型进行自适应机器翻译微调的开源项目。它解决···
codebase-for-incremental-learning-wi···
开源
让大模型学新知识不忘旧技能,复现ACL论文的增量学习工具箱
这是一个用于大语言模型增量学习的开源代码库,由ACL 2024相关论文官方发布,包含三篇工作的实现:···
EAGLE
开源
让大模型生成速度翻倍,无需牺牲输出质量
EAGLE是一个开源的大语言模型推理加速框架,由字节跳动团队开发,包含EAGLE-1、EAGLE-2和EAGLE-3三···
DiffuseKronA
开源
用更少参数微调扩散模型,生成更精准的个性化图像
DiffuseKronA 是一种面向个性化扩散模型的参数高效微调方法。它针对文本到图像生成中,用户希望用少···
TorchCP
开源
给深度学习预测加上可证明的可靠性边界,一行代码搞定不确定性量化。
TorchCP 是一个基于 PyTorch 的保形预测(Conformal Prediction)研究工具箱,专为深度学习模型设计···
unsloth
开源
本地一键跑起最新大模型,调教它不花一分钱
本地运行与训练文本、扩散模型的 UI 工具,支持 Kimi、Gemma、Qwen3.6、DeepSeek-V4、FLUX 等最新模···
RLHF-V
开源
用细粒度人类纠错对齐模型行为,大幅减少视觉幻觉。
RLHF-V 是一个面向多模态大语言模型(MLLMs)的可信行为对齐框架,核心解决模型在视觉对话中产生幻···
DDSM
开源
让扩散模型训练更快更省,按步骤智能分配学习资源
DDSM(Denoising Diffusion Step-aware Models)是ICLR 2024收录的扩散模型训练优化方法。它针对扩···
SwanLab
开源
一键跟踪训练指标,可视化对比实验,加速模型迭代
SwanLab 是一个开源、现代设计的 AI 训练跟踪与可视化工具,支持云端和自托管两种使用方式。它解决···
maestro
开源
一行命令微调多模态模型,快速搞定视觉语言任务
Maestro 是一个专注于多模态模型微调的开源工具,旨在简化 PaliGemma 2、Florence-2 和 Qwen2.5-VL···
reevo
开源
让大模型自动进化出高效启发式规则,解决优化难题
ReEvo 是一个基于大语言模型的超启发式算法(Hyper-Heuristics)框架,发表于 NeurIPS 2024。它旨在···
self-llm
开源
手把手教你微调部署开源大模型,中文教程一步到位
self-llm 是一个面向中文用户的开源大模型教程项目,旨在帮助开发者快速上手国内外开源大模型(LLM···
HALC
开源
减少多模态模型幻觉,让AI描述更可信
HALC 是一个针对多模态大语言模型(如 LLaVA)的物体幻觉抑制工具,基于 ICML 2024 论文实现。它通···
awesome-llms-fine-tuning
开源
一站式收藏LLM微调资源,从入门到进阶少走弯路
这是一个关于大语言模型微调的精选资源列表,汇集了教程、论文、工具和最佳实践。它旨在帮助机器学···
deita
开源
用更少的高质量数据,训出更强的对齐模型
Deita 是一个专注于数据高效指令微调的开源项目,旨在解决大语言模型对齐过程中数据质量参差不齐、···
LLM-FineTuning-Large-Language-Models
开源
跟着 Notebook 一步步学会大模型微调
该项目是一个专注于大语言模型(LLM)微调的教学型开源仓库,主要使用 Jupyter Notebook 编写,旨在···
raft
开源
微调+RAG双阶段,让AI代理精准模仿特定人物
RAFT(Retrieval-Augmented Fine-Tuning)是一个结合检索增强生成(RAG)与微调的开源方法库,旨在···
lorax
开源
一个服务跑上千个微调模型,省 GPU 又省心
Lorax 是一个专为大规模多 LoRA 推理而设计的高性能服务器,能够同时承载数千个微调后的 LLM。它解···