data-forcing-distillation
开源
少步生成视频,不丢多样性和画质
Data-Forcing Distillation (DFD) 是一个用于少步视频生成的蒸馏方法,旨在解决现有蒸馏技术在少步···
汇聚全球AI模型训练与微调项目,LoRA、全参微调、蒸馏、训练框架工具大全。
共收录 524 个开源项目
data-forcing-distillation
开源
少步生成视频,不丢多样性和画质
Data-Forcing Distillation (DFD) 是一个用于少步视频生成的蒸馏方法,旨在解决现有蒸馏技术在少步···
Rose
开源
无状态优化器,省内存,稳收敛,直接替换 Adam
Rose 是一个基于 PyTorch 的优化器,提出了一种名为 Range-Of-Slice Equilibration 的优化方法。它···
arkor
开源
用 TypeScript 搞定大模型微调,工程化更顺滑
arkor 是一个专注于大模型微调的 TypeScript 框架,旨在为开发者提供高效、类型安全的微调工具链。···
Awesome-Credit-Assignment-in-LLM-RL
开源
一榜看懂LLM强化学习信用分配,快速选型不迷路
这是一个关于大语言模型强化学习中信用分配问题的精选资源列表,收录了相关论文、分类体系、基准测···
Rethinking-OPD
开源
拆解大模型在线蒸馏为何翻车,给出可复现配方
Rethinking-OPD 是一个围绕大语言模型在线策略蒸馏(On-Policy Distillation, OPD)展开的研究型开···
kikiri-tts
开源
给 Kokoro 模型加新语言,照着文档就能微调
kikiri-tts 是一个针对 Kokoro-82M 模型进行新语言微调的开源训练方案,目前以德语为例。它解决了开···
DMax
开源
让扩散大模型生成提速,并行解码不再卡顿
DMax 是一个针对扩散大语言模型(dLLMs)的激进并行解码加速框架。扩散模型通过迭代去噪生成文本,···
gemma-tuner-multimodal
开源
Mac 上直接微调 Gemma 多模态模型,图文音一起训
gemma-tuner-multimodal 是一个面向 Apple Silicon 芯片的多模态微调工具,基于 PyTorch 和 Metal ···
Jackrong-llm-finetuning-guide
开源
跟着 Notebook 一步步微调大模型,少走弯路
这是一个面向开发者的 LLM 微调实战指南,基于 Jupyter Notebook 形式,系统讲解从数据准备、模型选···
Awesome-LLM-On-Policy-Distillation
开源
一网打尽LLM在线策略蒸馏论文,快速跟上研究前沿
这是一个关于大语言模型在线策略蒸馏(On-Policy Distillation)的精选资源清单,汇集了相关论文、···
VisionFoundry
开源
用合成图像训练VLM,低成本提升视觉感知能力
VisionFoundry 是一个专注于提升视觉语言模型(VLM)视觉感知能力的开源训练框架。它通过合成图像数···
awesome-on-policy-distillation
开源
一页看全 LLM 在线蒸馏论文与工具,省去到处翻找
这是一个围绕大语言模型在线策略蒸馏(On-Policy Distillation,OPD)的资源合集,系统整理了论文、···
mcore-bridge
开源
让 Megatron 像 Transformers 一样简单,直接训 500+ 大模型
mcore-bridge 是一个面向 Megatron-Core 的模型定义桥接库,目标是把 Megatron 的训练能力包装成类···
OnlineSPEC
开源
让草稿模型边推理边进化,解码速度越用越快
OnlineSPEC 是一个面向大语言模型推理加速的开源项目,核心思想是将投机解码(Speculative Decodin···
WaDi
开源
一步生成高质量图像,蒸馏时精准把控权重方向
WaDi 是一个面向一步图像合成的权重方向感知蒸馏框架,由 CVPR 2026 论文官方提供 PyTorch 实现。它···
cevahir-ai
开源
一站式搭建语言模型,从分词到聊天全流程
cevahir-ai 是一个全栈开源 AI 引擎,用于构建语言模型,覆盖从分词器训练、Transformer 架构、认知···
Visual-ERM
开源
训练视觉奖励模型,让AI输出更符合人类视觉偏好
Visual-ERM 是一个用于视觉等价性奖励建模的开源项目,提供了论文《Visual-ERM: Reward Modeling f···
rlix
开源
让 RL 实验排队更聪明,GPU 等待时间更短
rlix 是一个面向强化学习(RL)实验的基础设施工具,旨在解决 RL 研究者频繁运行实验时 GPU 等待时···
whichllm
开源
一条命令,找出你电脑上跑得最快的本地大模型
whichllm 是一个帮助用户在本地硬件上找到最适合运行的 LLM 模型的命令行工具。它解决的核心问题是···
nanochat-mlx
开源
在 Mac 上训练你自己的 ChatGPT,无需云 GPU
nanochat-mlx 是一个在 Apple Silicon 上训练类 ChatGPT 对话模型的开源项目,是 nanochat 的 MLX ···
lpwm
开源
用潜在粒子建模视频世界,预测未来更精准
lpwm(Latent Particle World Models)是一个面向视频生成与预测的物体中心世界模型,由ICLR 2026 ···
Qwen3-TTS-EasyFinetuning
开源
上传少量音频,快速克隆音色并微调多语言语音合成模型
Qwen3-TTS-EasyFinetuning 是一个面向 Qwen3-TTS 模型的简易微调工具,旨在让开发者快速实现声音克···
Soup
开源
一个YAML搞定大模型微调,4GB显卡也能训8B模型
Soup 是一个用于微调大语言模型(LLM)的开源工具,它通过一个 YAML 配置文件即可完成整个微调流程···
RandOpt
开源
在预训练权重附近挖出多个专家模型,提升泛化与集成效果
RandOpt 是 ICML 2026 Spotlight 论文《Neural Thickets: Diverse Task Experts Are Dense Around ···