SimPO 是模型训练领域的开源项目,由 princeton-nlp 开发,2024 年首次发布。
在全站 13,014 个收录项目中,它的 GitHub 星标数(959)位列前 30%,在模型训练分类中处于中上游。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-22。完全开源,MIT许可证,免费使用,无付费版本。
它主要面向的使用场景是:大模型指令微调后的偏好对齐阶段。同类可对比的替代方案包括 DPO (Direct Preference Optimization)、KTO (Kahneman-Tversky Optimization)、ORPO (O…。




