Вітаємо!

Reinforcement Learning з Gymnasium у Python

Fouad Trad

Machine Learning Engineer

Розділ 1

 

Вступ до навчання з підкріпленням
  • Основи RL
  • Каркас RL
  • Gymnasium

  Зображення: середовище надає агенту спостереження; агент виконує дії та отримує винагороди або штрафи залежно від цих дій.

Reinforcement Learning з Gymnasium у Python

Розділ 2

modelfree.png

Навчання з моделлю
  • Марковський процес прийняття рішень
  • Політики, функції цінності
  • Ітерація політики, ітерація цінності
Reinforcement Learning з Gymnasium у Python

Розділ 3

Навчання без моделі
  • Методи Монте-Карло
  • Навчання з часовою різницею
    • SARSA
    • Q-learning

Зображення робота, що взаємодіє з шаховим середовищем.

Reinforcement Learning з Gymnasium у Python

Розділ 4

lastchapter.png

Просунуті стратегії у model-free RL
  • Expected SARSA
  • Double Q-learning
  • Дослідження проти використання
  • «Однорукі бандити»
Reinforcement Learning з Gymnasium у Python

Наступні кроки

  • Пориньте в просунуті теми RL
  • Глибоке RL
  • Дослідження складніших середовищ
  • Створення власних середовищ

nextstep.png

Reinforcement Learning з Gymnasium у Python

Вітаємо!

Reinforcement Learning з Gymnasium у Python

Preparing Video For Download...