
rlhf-book-zh-tw
ai-twinkle
《Reinforcement Learning from Human Feedback》繁體中文全譯本+每章互動實驗 | Unofficial zh-TW community translation of the RLHF Book with interactive labs
AI 简介
这是一个面向中文学习者的《Reinforcement Learning from Human Feedback》(RLHF)繁体中文全译本及互动教学项目。项目完整翻译原书17章正文与3个附录,并为每章配套可离线运行的交互式实验工具,涵盖偏好建模、奖励建模、PPO/DPO算法可视化、KL散度分析、拒绝采样模拟等核心概念。技术上采用纯静态HTML实现,支持本地部署,所有实验基于前端JavaScript构建,无需服务器依赖。适用于AI研究者、大模型对齐方向学习者及高校教学场景,尤其适合希望通过动手实践理解RLHF原理的中文用户。
HTML
Other166
Stars
29
Forks
1
Watchers
0
Issues
Star 增长
今日0
近 7 天0
近 30 天+38
综合评分48.23
默认分支main