Gratulujeme!
Reinforcement Learning with Gymnasium in Python
Fouad Trad
Machine Learning Engineer
Kapitola 1
Úvod do zpětnovazebního učení
Základy RL
Rámec RL
Gymnasium
Kapitola 2
Učení s modelem
Markovův rozhodovací proces
Politiky, hodnotové funkce
Iterace politiky, iterace hodnot
Kapitola 3
Učení bez modelu
Metody Monte Carlo
Temporální diferenční učení
SARSA
Q-učení
Kapitola 4
Pokročilé strategie v RL bez modelu
Expected SARSA
Dvojité Q-učení
Explorace vs. exploatace
Mnohořaká bandita
Další kroky
Pokročilá témata v RL
Hluboké RL
Složitější prostředí
Vlastní prostředí
Gratulujeme!
Reinforcement Learning with Gymnasium in Python
Preparing Video For Download...