おめでとうございます!
Pythonで学ぶGymnasiumによるReinforcement Learning
Fouad Trad
Machine Learning Engineer
第1章
強化学習入門
RLの基礎
RLフレームワーク
Gymnasium
第2章
モデルベース学習
マルコフ決定過程
方策・価値関数
方策反復・価値反復
第3章
モデルフリー学習
モンテカルロ法
時間差学習
SARSA
Q-learning
第4章
モデルフリーRLの高度な戦略
Expected SARSA
Double Q-learning
探索と活用
多腕バンディット
次のステップ
先端的なRLトピックへ
深層RL
より複雑な環境の探索
独自環境の作成
おめでとうございます!
Pythonで学ぶGymnasiumによるReinforcement Learning
Preparing Video For Download...