thu-ml

tianshou

thu-ml

An elegant PyTorch deep reinforcement learning library.

AI 简介

Tianshou 是一个基于纯 PyTorch 的深度强化学习(DRL)开源库,专注于提供模块化、类型安全且高性能的 RL 算法实现。核心特性包括清晰分离的算法(Algorithm)与策略(Policy)抽象、支持在线(on/off-policy)与离线(offline)RL 的统一框架、对 Gymnasium 环境的原生兼容,以及对 PPO、SAC、DQN、TD3、CQL、BCQ 等主流算法的完整支持。适用于强化学习算法研发、教学实验、智能体训练及科研复现等场景,兼顾研究灵活性与工程易用性。

Python
MIT License
10.8k
Stars
1.3k
Forks
97
Watchers
130
Issues

Star 增长

今日0
近 7 天0
近 30 天+23
综合评分71.66
默认分支master