deep-reinforcement-learning

本站收录 10 个带「deep-reinforcement-learning」标签的 AI 开源项目

carlaCARLA 是一个开源的自动驾驶研究模拟器,基于 C++ 和虚幻引擎构建,提供高保真的城市环境、车辆动力学、传感器模拟(如摄像头、激光雷达)以及交通流控制。它解★ 14,443deep-learning-drizzle这是一个深度学习相关学习资源的精选合集,汇集了全球顶尖大学和机构的免费视频讲座,覆盖深度学习、强化学习、机器学习、计算机视觉和自然语言处理等核心领域。项目以分类★ 12,956introtodeeplearningMIT 6.S191《深度学习导论》课程的官方实验材料,包含一系列Jupyter Notebook教程,覆盖深度学习基础、计算机视觉、自然语言处理、生成模型等核★ 8,822LLMBook-zh.github.io《大语言模型》是一本由中国人民大学赵鑫教授团队编写的中文开源教材,旨在系统性地介绍大语言模型的技术原理、架构设计与应用实践。全书覆盖从基础概念到前沿进展的完整知★ 4,584awesome-RLHFawesome-RLHF 是一个持续更新的强化学习与人类反馈(RLHF)资源精选列表。它系统整理了 RLHF 领域的论文、教程、代码库、数据集和工具,帮助研究者★ 4,431AgileRLAgileRL 是一个专注于强化学习(RL)的 Python 库,旨在通过 RLOps(强化学习运维)理念简化 RL 算法的开发、训练和部署流程。它解决了 RL★ 952Machine-Learning-Goodness这是一个面向机器学习与深度学习学习者的综合资源库,收录了ML/DL项目、Jupyter Notebook教程、速查表(cheat codes)、AI/AGI实用★ 286RaveForceRaveForce 是一个面向音乐生成实验的 OpenAI Gym 风格工具包。它解决了音乐生成研究中缺乏标准化实验环境的问题,为强化学习(RL)和生成式模型提★ 252Deep-Reinforcement-Learning-for-Dialogue-Generation-in-tensorflow这是一个基于TensorFlow的深度强化学习对话生成项目,旨在解决传统seq2seq模型在对话生成中易产生重复、无意义回复的问题。项目将对话生成建模为强化学习★ 189GO-Bot-DRLGO-Bot-DRL 是一个基于深度强化学习的目标导向对话机器人项目,旨在解决任务型对话系统中的策略优化问题。它通过模拟用户与系统交互,训练对话策略以完成特定目★ 180