恭喜你!
使用 Python 的 Gymnasium 進行強化學習
Fouad Trad
Machine Learning Engineer
第 1 章
強化學習入門
RL 基礎
RL 架構
Gymnasium
第 2 章
有模型學習(Model-based)
Markov 決策過程
策略、價值函式
策略反覆、價值反覆
第 3 章
無模型學習(Model-Free)
Monte Carlo 方法
時序差分學習
SARSA
Q-learning
第 4 章
無模型 RL 的進階策略
Expected SARSA
Double Q-learning
探索-利用
多拉霸(Multi-armed bandits)
下一步
進一步探討進階 RL 主題
深度 RL
探索更複雜的環境
建立你自己的環境
恭喜你!
使用 Python 的 Gymnasium 進行強化學習
Preparing Video For Download...