恭喜你!

使用 Python 的 Gymnasium 進行強化學習

Fouad Trad

Machine Learning Engineer

第 1 章

 

強化學習入門
  • RL 基礎
  • RL 架構
  • Gymnasium

  環境提供觀測給代理人,代理人採取動作,並依動作獲得獎勵或懲罰的示意圖。

使用 Python 的 Gymnasium 進行強化學習

第 2 章

modelfree.png

有模型學習(Model-based)
  • Markov 決策過程
  • 策略、價值函式
  • 策略反覆、價值反覆
使用 Python 的 Gymnasium 進行強化學習

第 3 章

無模型學習(Model-Free)
  • Monte Carlo 方法
  • 時序差分學習
    • SARSA
    • Q-learning

機器人與西洋棋環境互動的示意圖。

使用 Python 的 Gymnasium 進行強化學習

第 4 章

lastchapter.png

無模型 RL 的進階策略
  • Expected SARSA
  • Double Q-learning
  • 探索-利用
  • 多拉霸(Multi-armed bandits)
使用 Python 的 Gymnasium 進行強化學習

下一步

  • 進一步探討進階 RL 主題
  • 深度 RL
  • 探索更複雜的環境
  • 建立你自己的環境

nextstep.png

使用 Python 的 Gymnasium 進行強化學習

恭喜你!

使用 Python 的 Gymnasium 進行強化學習

Preparing Video For Download...