
cleanrl
vwxyzjn
High-quality single file implementation of Deep Reinforcement Learning algorithms with research-friendly features (PPO, DQN, C51, DDPG, TD3, SAC, PPG)
AI 简介
CleanRL 是一个高质量的深度强化学习算法单文件实现库,提供 PPO、DQN、SAC 等 7+ 主流算法的简洁、可读、可复现参考实现。核心特点是每个算法与环境组合(如 PPO+Atari)封装在单一 Python 文件中,代码精简(平均约 300–400 行),内置 TensorBoard 日志、W&B 实验追踪、游戏视频录制、确定性种子控制及云平台(AWS Batch)扩展支持。适用于强化学习教学、算法复现、基准测试与中小型研究实验,尤其适合需要快速验证或深入理解算法细节的研究者与工程师。
Python
Other10.1k
Stars
1.1k
Forks
47
Watchers
68
Issues
Star 增长
今日0
近 7 天0
近 30 天+73
综合评分76.45
默认分支master