Základy zpětnovazebního učení

Reinforcement Learning with Gymnasium in Python

Fouad Trad

Machine Learning Engineer

Zpětnovazební učení

 

  • Agent se učí metodou pokus a omyl

 

Obrázek znázorňující dvě ikony: agenta a prostředí.

Reinforcement Learning with Gymnasium in Python

Zpětnovazební učení

 

  • Agent se učí metodou pokus a omyl

 

Obrázek znázorňující, že pozorování jsou předávána z prostředí agentovi.

Reinforcement Learning with Gymnasium in Python

Zpětnovazební učení

 

  • Agent se učí metodou pokus a omyl

 

Obrázek znázorňující, že prostředí poskytuje agentovi pozorování a agent podle nich provádí akce.

Reinforcement Learning with Gymnasium in Python

Zpětnovazební učení

 

  • Agent se učí metodou pokus a omyl
  • Agent přijímá:
    • Odměny za správná rozhodnutí
    • Penalizace za špatná rozhodnutí
  • Cíl: maximalizovat pozitivní zpětnou vazbu

 

Obrázek znázorňující, že prostředí poskytuje agentovi pozorování, agent provádí akce a na jejich základě přijímá odměny nebo penalizace.

Reinforcement Learning with Gymnasium in Python

RL jako trénování domácího mazlíčka

Obrázek zobrazující starého muže (prostředí) trénujícího domácího mazlíčka (agenta).

Reinforcement Learning with Gymnasium in Python

RL vs. ostatní typy ML

Obrázek tabulky s nadpisem „Supervised Learning", typ dat jsou označená data, hlavním cílem je předpovídat výsledky na základě vstupních dat, vhodné pro klasifikaci a regresi.

Reinforcement Learning with Gymnasium in Python

RL vs. ostatní typy ML

Obrázek tabulky porovnávající Supervised a Unsupervised Learning. Supervised Learning: označená data, cíl předpovídat výsledky, vhodné pro klasifikaci a regresi. Unsupervised Learning: neoznačená data, cíl odhalovat vzory nebo asociace, vhodné pro shlukování a analýzu asociací.

Reinforcement Learning with Gymnasium in Python

RL vs. ostatní typy ML

Obrázek tabulky rozšiřující srovnání o RL. Supervised Learning: označená data, předpovídání výsledků, klasifikace a regrese. Unsupervised Learning: neoznačená data, odhalování vzorů, shlukování. RL: nevyžaduje předdefinovaná tréninková data, zaměřuje se na maximalizaci odměn z prostředí, vhodné pro rozhodovací úlohy.

Reinforcement Learning with Gymnasium in Python

Kdy použít RL?

 

  • Sekvenční rozhodování
    • Rozhodnutí ovlivňují budoucí pozorování
  • Učení prostřednictvím odměn a penalizací
    • Bez přímého dohledu

Ikona robota

Reinforcement Learning with Gymnasium in Python

Vhodné pro RL: hraní videoher

  • Hráč přijímá sekvenční rozhodnutí
  • Získává body nebo ztrácí životy podle akcí

Obrázek herní scény, kde agent přijímá rozhodnutí.

Reinforcement Learning with Gymnasium in Python

Nevhodné pro RL: rozpoznávání objektů ve hře

  • Žádné sekvenční rozhodování
  • Žádná interakce s prostředím

Obrázek herní scény, kde cílem je rozpoznat různé druhy pokémonů.

Reinforcement Learning with Gymnasium in Python

Aplikace RL

Robotika
  • Chůze robota
  • Manipulace s objekty

Obrázek robotické ruky.

Reinforcement Learning with Gymnasium in Python

Aplikace RL

Robotika
  • Chůze robota
  • Manipulace s objekty

Obrázek robotické ruky.

Finance
  • Optimalizace obchodování a investic
  • Maximalizace zisku

Obrázek znázorňující velkou sumu peněz vyletující z otevřeného kufříku na modrém pozadí, symbolizující finanční úspěch.

Reinforcement Learning with Gymnasium in Python

Aplikace RL

Autonomní vozidla
  • Zvýšení bezpečnosti a efektivity
  • Minimalizace rizika nehod

Obrázek znázorňující autonomní vozidla na silnici.

Reinforcement Learning with Gymnasium in Python

Aplikace RL

Autonomní vozidla
  • Zvýšení bezpečnosti a efektivity
  • Minimalizace rizika nehod

Obrázek znázorňující autonomní vozidla na silnici.

Vývoj chatbotů
  • Zlepšení konverzačních schopností
  • Zlepšení uživatelského zážitku

Obrázek konverzačního chatbota.

Reinforcement Learning with Gymnasium in Python

Co nás čeká?

V tomto kurzu:

  • Porozumění základům a principům RL
  • Identifikace, formulace a řešení úloh RL
  • Aplikace s Gymnasium

Logo Gymnasium.

Reinforcement Learning with Gymnasium in Python

Pojďme si to procvičit!

Reinforcement Learning with Gymnasium in Python

Preparing Video For Download...