축하합니다!
Python으로 배우는 Gymnasium 기반 Reinforcement Learning
Fouad Trad
Machine Learning Engineer
챕터 1
강화학습 입문
RL 기본 개념
RL 프레임워크
Gymnasium
챕터 2
모델 기반 학습
마르코프 결정 과정
정책, 가치 함수
정책 반복, 가치 반복
챕터 3
모델프리 학습
몬테카를로 방법
시차 학습(Temporal Difference)
SARSA
Q-learning
챕터 4
모델프리 RL 고급 전략
Expected SARSA
Double Q-learning
탐색-활용 균형
다중 슬롯머신 문제
다음 단계
RL 고급 주제 살펴보기
딥 RL
더 복잡한 환경 탐색
나만의 환경 만들기
축하합니다!
Python으로 배우는 Gymnasium 기반 Reinforcement Learning
Preparing Video For Download...