tirex
开源
零样本预测长短周期,无需训练直接上手
TiRex 是一个面向时间序列预测的开源模型,主打零样本(Zero-Shot)跨长短周期预测,并强化了上下文···
汇聚全球AI模型训练与微调项目,LoRA、全参微调、蒸馏、训练框架工具大全。
共收录 524 个开源项目
tirex
开源
零样本预测长短周期,无需训练直接上手
TiRex 是一个面向时间序列预测的开源模型,主打零样本(Zero-Shot)跨长短周期预测,并强化了上下文···
RPG
开源
给大模型 RL 训练加上安全护栏,稳定提升性能
RPG 是一个基于 KL 正则化策略梯度的强化学习训练框架,源自 ICLR 2026 论文。它旨在解决大语言模型···
LongCodeZip
开源
压缩长代码上下文,让模型轻松处理超长代码
LongCodeZip 是一个面向代码语言模型的长上下文压缩工具,源自 ASE 2025 论文。它解决的是代码大模···
TreeLoRA
开源
用树状 LoRA 分层管理任务,持续学习不遗忘
TreeLoRA 是 ICML 2025 论文的 PyTorch 实现,面向持续学习(Continual Learning)场景,提出一种基···
HoliTom
开源
合并视频令牌,让视频大模型推理快数倍
HoliTom是一个针对视频大语言模型(Video LLM)的推理加速工具,核心思路是“整体令牌合并”(Holi···
VeriThinker
开源
让模型学会自我验证,推理更快更准
VeriThinker 是一个基于 NeurIPS 2025 论文的开源推理模型,旨在通过引入验证机制来提升大语言模型···
Complete-LLM-Finetuning
开源
跟着 Notebook 跑一遍,就能亲手微调大模型
Complete-LLM-Finetuning 是一个以 Jupyter Notebook 形式呈现的大语言模型微调全流程教程项目,目···
Scaling-Diffusion-Transformers-muP
开源
让扩散模型从小规模到大规模训练,超参数无需重调,省时省力。
Scaling-Diffusion-Transformers-muP 是 NeurIPS 2025 论文的官方实现,旨在解决扩散 Transformer(···
Automodel
开源
Hugging Face 模型直接多卡分布式微调,不改代码。
Automodel 是一个基于 PyTorch 分布式原生的 LLM/VLM 训练库,目标是让大模型微调像调用 Hugging F···
verbalized-sampling
开源
让LLM输出带概率的多样答案,告别重复文本
Verbalized Sampling 是一个无需训练的提示词策略框架,旨在通过让大语言模型以概率形式输出候选答···
BitVAE
开源
用比特级分词,让图像生成更精细高效
BitVAE 是一个图像分词器(tokenizer)的官方训练与推理代码库,属于自回归图像生成模型的基础组件···
RLVR-World
开源
用强化学习训练能用于决策的视频生成世界模型
RLVR-World 是 NeurIPS 2025 论文《Training World Models with Reinforcement Learning》的官方实···
Time-R1
开源
让大模型像专家一样一步步推理预测时间序列
Time-R1 是一个两阶段强化微调框架,用于训练大语言模型进行慢思考、逐步推理,以实现准确且可解释···
Time-R1
开源
用三阶段强化学习,让大模型真正理解时间、预测未来。
Time-R1 是一个旨在赋予大语言模型(LLM)全面时间推理能力的开源框架和资源集合。它解决的是当前 ···
ParScale
开源
并行跑多个模型,不堆参数也能提升性能
ParScale 是一个研究并行扩展定律(Parallel Scaling Law)的开源项目,旨在突破传统语言模型仅依赖···
GuidedQuant
开源
用端到端损失引导量化,让大模型压缩后不掉点
GuidedQuant 是 ICML 2025 论文的官方 PyTorch 实现,提出一种利用端到端损失引导的大语言模型量化···
mlx-lm-lora
开源
Mac 上微调大模型,LoRA/DPO 一条命令跑通
mlx-lm-lora 是面向 Apple Silicon 的 LLM 训练工具,基于苹果 MLX 框架,让 Mac 用户无需 NVIDIA ···
SkyRL
开源
把 LLM 强化学习全流程拆成乐高,多轮工具任务也能直接训
SkyRL 是一个面向大语言模型的模块化全栈强化学习库,目标是把 RL 训练 LLM 所需的各个环节——环境···
onebitllms
开源
小显存也能训练1.58bit三值大模型
onebitllms 是一个轻量级 Python 工具包,专注于训练和微调 1.58bit 量化语言模型。传统大模型动辄···
lightly-train
开源
一个命令搞定视觉模型预训练、微调和蒸馏,告别碎片化流程。
lightly-train 是一个面向视觉模型的一体化训练框架,支持 YOLO、ViT、RT-DETR、DINOv3 等主流架构···
d1
开源
用强化学习给扩散大模型补上推理能力
d1 是论文《d1: Scaling Reasoning in Diffusion Large Language Models via Reinforcement Learni···
LoRI
开源
多任务微调不打架,LoRA 参数更高效
LoRI 是一个针对多任务低秩适配(LoRA)的改进方法,旨在解决多任务学习中的跨任务干扰问题。它通过···
Trinity-RFT
开源
搭好LLM强化微调流水线,换算法扩规模不用重写
Trinity-RFT 是一个面向大语言模型强化微调(RFT)的通用框架,目标是把 RLHF/RFT 从单机脚本式实验···
tunix
开源
用 JAX 搭积木做 LLM 后训练,算法随便换
Tunix 是 Google 开源的一个轻量级大模型后训练(post-training)库,基于 JAX 生态构建,专注于在···