DLR-RM

stable-baselines3

DLR-RM

PyTorch version of Stable Baselines, reliable implementations of reinforcement learning algorithms.

AI 简介

Stable Baselines3(SB3)是一个基于PyTorch的强化学习算法可靠实现库,提供PPO、SAC、A2C、DQN等主流算法的统一、可复现接口。核心特点包括标准化API、对字典型观测空间的支持、自定义策略与环境的灵活性、完整文档与TensorBoard日志集成,并经基准测试验证性能稳定性。适用于强化学习算法研究、教学实验、机器人控制仿真及游戏AI等需要快速验证与对比RL方法的场景。

Python
MIT License
13.6k
Stars
2.2k
Forks
65
Watchers
57
Issues

Star 增长

今日0
近 7 天0
近 30 天+64
综合评分45
默认分支master