恭喜!

Python 中的 Gymnasium 强化学习

Fouad Trad

Machine Learning Engineer

第1章

 

强化学习简介
  • RL基础
  • RL框架
  • Gymnasium

  图示:环境向智能体提供观测,智能体执行动作,并根据动作获得奖励或惩罚。

Python 中的 Gymnasium 强化学习

第2章

基于模型

基于模型的学习
  • 马尔可夫决策过程
  • 策略、价值函数
  • 策略迭代、价值迭代
Python 中的 Gymnasium 强化学习

第3章

无模型学习
  • 蒙特卡罗方法
  • 时序差分学习
    • SARSA
    • Q学习

机器人与棋类环境交互的图示。

Python 中的 Gymnasium 强化学习

第4章

最后一章

无模型强化学习的高级策略
  • 期望SARSA
  • 双Q学习
  • 探索-利用权衡
  • 多臂老虎机
Python 中的 Gymnasium 强化学习

后续步骤

  • 深入高级RL主题
  • 深度RL
  • 探索更复杂的环境
  • 创建您自己的环境

下一步

Python 中的 Gymnasium 强化学习

恭喜!

Python 中的 Gymnasium 强化学习

Preparing Video For Download...