恭喜!
Python 中的 Gymnasium 强化学习
Fouad Trad
Machine Learning Engineer
第1章
强化学习简介
RL基础
RL框架
Gymnasium
第2章
基于模型的学习
马尔可夫决策过程
策略、价值函数
策略迭代、价值迭代
第3章
无模型学习
蒙特卡罗方法
时序差分学习
SARSA
Q学习
第4章
无模型强化学习的高级策略
期望SARSA
双Q学习
探索-利用权衡
多臂老虎机
后续步骤
深入高级RL主题
深度RL
探索更复杂的环境
创建您自己的环境
恭喜!
Python 中的 Gymnasium 强化学习
Preparing Video For Download...