PRIME 是模型训练领域的开源项目,由 PRIME-RL 开发,2024 年首次发布。
在全站 13,090 个收录项目中,它的 GitHub 星标数(1,872)位列前 30%,在模型训练分类中处于中上游。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-19。Apache-2.0许可证,可免费使用和部署。
它主要面向的使用场景是:大模型数学推理能力增强。同类可对比的替代方案包括 TRL、OpenRLHF、verl。

⚠ 该项目 README 未提供完整安装说明,以下步骤为通用流程,请以官方文档为准。
1克隆项目仓库
README 未给安装命令,先从项目地址拉取代码,得到 training、data_preprocessing、eval 三个目录。
git clone https://github.com/PRIME-RL/PRIME.git2进入项目目录
切换到仓库根目录,后续脚本与数据准备都以该目录为基准。
cd PRIME3安装推理依赖
README 推理示例导入了这些库,建议在独立虚拟环境中安装,版本按各自兼容性选择。
pip install torch transformers vllm tqdm4设置任务提示词
数学题追加 Present the answer in LaTex format: oxed{Your answer};代码题追加代码输出提示词。
5编写推理脚本
把 README 的 inference code 保存为 py 文件,按需修改 model_path 与 all_problems。
6运行推理验证
执行保存的脚本,观察控制台打印的 completions 与推理步骤是否符合预期。
python prime_inference.py| 配置项 | 必填 | 说明 | 示例 |
|---|---|---|---|
model_path | 是 | 要加载的模型路径或 HuggingFace 模型名 | PRIME-RL/Eurus-2-7B-PRIME |
tensor_parallel_size | 否 | 张量并行规模,示例取当前可见 GPU 数量 | torch.cuda.device_count() |
gpu_memory_utilization | 否 | vLLM 占用的显存比例 | 0.90 |
max_tokens | 否 | 采样最大生成长度 | 8192 |
temperature | 否 | 采样温度,示例为贪心解码 | 0.0 |
n | 否 | 每个问题的采样条数 | 1 |
脚本打印出回答,内容含 [ASSESS]/[ADVANCE]/[OUTPUT] 等推理步骤并以 oxed{9.9} 给出结论即为成功。
Q:训练、数据处理和评测代码分别在哪里?
A:README 说明 training 为训练实现与脚本,data_preprocessing 负责数据准备(尤其是数学数据),eval 为复现结果的评测脚本。
Q:隐式 PRM 的训练和评测怎么做?
A:README 指引到 PRIME-RL/ImplicitPRM 这个独立仓库,不在本仓库内提供。
Q:不同任务需要不同提示词吗?
A:需要。数学题使用 LaTex oxed{} 提示词,代码题使用要求以 ```python``` 代码块给出解答的提示词。
Q:有没有更省事的集成方式?
A:2025/03/12 起 PRIME 已合并进 veRL 主分支,可直接使用 volcengine/verl 的 recipe/prime 目录。
TRL、OpenRLHF、verl
PRIME 是模型训练领域的开源项目,由 PRIME-RL 开发,2024 年首次发布。
在全站 13,090 个收录项目中,它的 GitHub 星标数(1,872)位列前 30%,在模型训练分类中处于中上游。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-19。Apache-2.0许可证,可免费使用和部署。
它主要面向的使用场景是:大模型数学推理能力增强。同类可对比的替代方案包括 TRL、OpenRLHF、verl。
下一篇:katib
Long-RL
开源
让强化学习轻松驾驭超长序列,训练更稳更快
Long-RL: Scaling RL to Long Sequences (NeurIPS 2025)
TPA
开源
把注意力复杂度从平方降到线性,长序列不再卡顿
[NeurIPS 2025 Spotlight] TPA: Tensor ProducT ATTenTion Transformer (https://arxiv.or···
minimind
开源
两小时造出你的小模型,练手入门不求人
Train a 64M-parameter LLM from scratch in just 2h!
pruna
开源
一键优化 AI 模型,推理提速又省资源。
Pruna is a model optimization framework built for developers, enabling you to delive···