
PufferLib
PufferAI
Puffing up reinforcement learning
AI 简介
PufferLib 是一个高性能强化学习库,专为快速训练轻量级、高效率的智能体模型而设计。核心特点包括用 C 语言实现的底层加速、内置自研的高效 RL 算法(如 PPO 变体)、自动化超参调优支持及可扩展的仿真环境接口。它兼顾易用性与性能,在单机上即可在数秒内完成小型策略模型的训练与验证。适用于教育研究、算法原型验证、边缘设备部署及需要低延迟响应的仿真控制任务,如机器人控制、游戏 AI 和资源调度模拟等场景。
C
MIT License6.1k
Stars
516
Forks
30
Watchers
28
Issues
Star 增长
今日0
近 7 天0
近 30 天+73
综合评分71.44
默认分支4.0