Repo2RLEnv 是模型训练领域的开源项目,由 huggingface 开发,是 2026 年新上线的项目。
它收录于模型训练分类,该分类目前共有 534 个项目,GitHub 星标数为 696。
项目目前处于活跃维护状态,最近一次代码更新于 2026-09-30。免费使用。
它主要面向的使用场景是:为编码智能体构建大规模强化学习训练环境。同类可对比的替代方案包括 SWE-bench、OpenHands、SWE-agent。

任意仓库一键变可验证 RL 训练环境,边训边评测
Repo2RLEnv 是一个把任意代码仓库自动转换为可验证强化学习环境的工具,面向训练和评估编码智能体(coding agents)。它解决的核心问题是:现有编码智能体的 RL 训练环境往往需要人工搭建、难以复用和共享,导致训练数据与评测流程割裂。Repo2RLEnv 通过解析仓库结构、依赖和测试用例,生成带可验证奖励信号的环境(Harbor 任务),让智能体在真实代码库中执行任务并自动判定成败。生成的环境可以直接用于强化学习训练、基准评测,并支持上传到 Hugging Face Hub 进行分享和复用。项目基于 Python,兼容 SWE-bench 等编码智能体评测体系,适合需要大规模、可验证训练信号的团队快速构建自有 RL 环境。
本站每日记录该项目 GitHub 星标变化,观测越久曲线越完整
—
SWE-bench、OpenHands、SWE-agent
Repo2RLEnv 是模型训练领域的开源项目,由 huggingface 开发,是 2026 年新上线的项目。
它收录于模型训练分类,该分类目前共有 534 个项目,GitHub 星标数为 696。
项目目前处于活跃维护状态,最近一次代码更新于 2026-09-30。免费使用。
它主要面向的使用场景是:为编码智能体构建大规模强化学习训练环境。同类可对比的替代方案包括 SWE-bench、OpenHands、SWE-agent。
上一篇:labs-molt
下一篇:没有了!
Long-RL
开源
让强化学习轻松驾驭超长序列,训练更稳更快
Long-RL: Scaling RL to Long Sequences (NeurIPS 2025)
TPA
开源
把注意力复杂度从平方降到线性,长序列不再卡顿
[NeurIPS 2025 Spotlight] TPA: Tensor ProducT ATTenTion Transformer (https://arxiv.or···
minimind
开源
两小时造出你的小模型,练手入门不求人
Train a 64M-parameter LLM from scratch in just 2h!
pruna
开源
一键优化 AI 模型,推理提速又省资源。
Pruna is a model optimization framework built for developers, enabling you to delive···