おめでとうございます!

Pythonで学ぶGymnasiumによるReinforcement Learning

Fouad Trad

Machine Learning Engineer

第1章

 

強化学習入門
  • RLの基礎
  • RLフレームワーク
  • Gymnasium

  環境がエージェントに観測を与え、エージェントが行動し、その結果として報酬や罰を受け取ることを示す画像。

Pythonで学ぶGymnasiumによるReinforcement Learning

第2章

モデルフリーの画像

モデルベース学習
  • マルコフ決定過程
  • 方策・価値関数
  • 方策反復・価値反復
Pythonで学ぶGymnasiumによるReinforcement Learning

第3章

モデルフリー学習
  • モンテカルロ法
  • 時間差学習
    • SARSA
    • Q-learning

チェス環境とやり取りするロボットの画像。

Pythonで学ぶGymnasiumによるReinforcement Learning

第4章

最終章の画像

モデルフリーRLの高度な戦略
  • Expected SARSA
  • Double Q-learning
  • 探索と活用
  • 多腕バンディット
Pythonで学ぶGymnasiumによるReinforcement Learning

次のステップ

  • 先端的なRLトピックへ
  • 深層RL
  • より複雑な環境の探索
  • 独自環境の作成

次のステップの画像

Pythonで学ぶGymnasiumによるReinforcement Learning

おめでとうございます!

Pythonで学ぶGymnasiumによるReinforcement Learning

Preparing Video For Download...