Вітаємо!
Reinforcement Learning з Gymnasium у Python
Fouad Trad
Machine Learning Engineer
Розділ 1
Вступ до навчання з підкріпленням
Основи RL
Каркас RL
Gymnasium
Розділ 2
Навчання з моделлю
Марковський процес прийняття рішень
Політики, функції цінності
Ітерація політики, ітерація цінності
Розділ 3
Навчання без моделі
Методи Монте-Карло
Навчання з часовою різницею
SARSA
Q-learning
Розділ 4
Просунуті стратегії у model-free RL
Expected SARSA
Double Q-learning
Дослідження проти використання
«Однорукі бандити»
Наступні кроки
Пориньте в просунуті теми RL
Глибоке RL
Дослідження складніших середовищ
Створення власних середовищ
Вітаємо!
Reinforcement Learning з Gymnasium у Python
Preparing Video For Download...