
learning-beyond-gradients
Trinkle23897
Heuristic Learning Blog Post
AI 简介
该项目是关于超越梯度优化的启发式学习方法的技术博客配套代码库,聚焦于无需梯度信号的强化学习策略设计与实证分析。核心内容涵盖Atari(Pong/Breakout/Montezuma/Atari57)、MuJoCo(Ant/HalfCheetah)及VizDoom等环境下的启发式策略实现、实验数据、可视化图表、视频回放及可复现命令脚本;技术上依托EnvPool加速环境仿真,并提供双语Markdown源文件与自动化HTML渲染工具。适用于强化学习研究者探索无梯度范式、启发式策略设计、样本效率评估及跨环境策略迁移等场景。
Python
588
Stars
58
Forks
3
Watchers
15
Issues
Star 增长
今日0
近 7 天0
近 30 天+10
综合评分47.31
默认分支main