Gratulacje!
Uczenie przez wzmacnianie z Gymnasium w Pythonie
Fouad Trad
Machine Learning Engineer
Rozdział 1
Wprowadzenie do uczenia przez wzmacnianie
Podstawy RL
Schemat RL
Gymnasium
Rozdział 2
Uczenie oparte na modelu
Markowski proces decyzyjny
Polityki, funkcje wartości
Iteracja polityki, iteracja wartości
Rozdział 3
Uczenie bez modelu
Metody Monte Carlo
Uczenie różnic czasowych
SARSA
Q-learning
Rozdział 4
Zaawansowane strategie w RL bez modelu
Expected SARSA
Podwójne Q-learning
Eksploracja a eksploatacja
Wielorękie bandyty
Kolejne kroki
Zaawansowane tematy RL
Głębokie RL
Bardziej złożone środowiska
Tworzenie własnych środowisk
Gratulacje!
Uczenie przez wzmacnianie z Gymnasium w Pythonie
Preparing Video For Download...