
QWOP_rl_training_public
LYiHub
跑步游戏强化学习训练框架
AI 简介
这是一个面向QWOP跑步游戏的强化学习训练框架,提供基于物理模拟的Windows原生环境、支持多线程批量交互的Python API,以及完整的PPO训练与策略蒸馏流程。核心特点包括可配置的奖励函数(支持100米短跑、110米跨栏、跳远三种模式)、C++加速的物理仿真、PyTorch实现的Actor-Critic网络及回放导出功能。适用于强化学习算法研究、游戏AI行为建模、连续控制任务验证等场景,特别适合在Windows平台开展基于真实物理反馈的策略训练。
Python
Apache License 2.0139
Stars
23
Forks
101
Watchers
0
Issues
Star 增长
今日0
近 7 天0
近 30 天0
综合评分44.14
默认分支main