강화학습 기초

Python으로 배우는 Gymnasium 기반 Reinforcement Learning

Fouad Trad

Machine Learning Engineer

강화학습

 

  • 에이전트는 시행착오로 학습합니다

 

에이전트 아이콘과 환경 아이콘 두 개를 보여주는 이미지.

Python으로 배우는 Gymnasium 기반 Reinforcement Learning

강화학습

 

  • 에이전트는 시행착오로 학습합니다

 

환경이 에이전트에게 관측을 제공함을 보여주는 이미지.

Python으로 배우는 Gymnasium 기반 Reinforcement Learning

강화학습

 

  • 에이전트는 시행착오로 학습합니다

 

환경이 에이전트에게 관측을 제공하고, 에이전트가 그에 따라 행동함을 보여주는 이미지.

Python으로 배우는 Gymnasium 기반 Reinforcement Learning

강화학습

 

  • 에이전트는 시행착오로 학습합니다
  • 에이전트는 다음을 받습니다:
    • 올바른 결정에 대한 보상
    • 잘못된 결정에 대한 페널티
  • 목표: 시간이 지남에 따라 긍정적 피드백을 극대화

 

환경이 에이전트에게 관측을 제공하고, 에이전트가 행동을 수행한 뒤 그에 따라 보상이나 페널티를 받는 모습을 보여주는 이미지.

Python으로 배우는 Gymnasium 기반 Reinforcement Learning

반려동물 훈련에 비유한 RL

노인(환경)이 반려동물(에이전트)을 훈련하는 모습을 보여주는 이미지.

Python으로 배우는 Gymnasium 기반 Reinforcement Learning

RL vs. 다른 ML 유형

"지도학습" 표로, 데이터 유형은 라벨된 데이터, 주요 목표는 입력 기반 예측, 적용 분야는 분류·회귀임을 나타냅니다.

Python으로 배우는 Gymnasium 기반 Reinforcement Learning

RL vs. 다른 ML 유형

지도학습과 비지도학습을 비교하는 표. 지도학습: 라벨된 데이터, 입력 기반 예측, 분류·회귀에 적합. 비지도학습: 라벨 없는 데이터, 패턴/연관성 발견, 군집화·연관 분석에 적합.

Python으로 배우는 Gymnasium 기반 Reinforcement Learning

RL vs. 다른 ML 유형

표가 RL을 지도·비지도학습과 함께 비교합니다. 지도학습: 라벨된 데이터로 예측, 분류·회귀에 적합. 비지도학습: 라벨 없는 데이터로 패턴/연관성 발견, 군집화·연관 분석에 적합. RL은 사전 정의된 학습 데이터가 필요 없고, 환경에서의 보상을 극대화하는 의사결정에 초점을 맞추며, 의사결정 작업에 적합합니다.

Python으로 배우는 Gymnasium 기반 Reinforcement Learning

RL을 언제 사용할까?

 

  • 순차적 의사결정
    • 결정이 미래 관측에 영향
  • 보상과 페널티로 학습
    • 직접적 감독 없음

로봇 아이콘

Python으로 배우는 Gymnasium 기반 Reinforcement Learning

RL에 적합: 비디오 게임 플레이

  • 플레이어가 순차적으로 의사결정
  • 행동에 따라 점수 획득·목숨 소실

에이전트가 결정을 내리는 비디오 게임 장면 이미지.

Python으로 배우는 Gymnasium 기반 Reinforcement Learning

RL에 부적합: 게임 내 객체 인식

  • 순차적 의사결정 없음
  • 환경과의 상호작용 없음

게임 화면에서 다양한 포켓몬을 인식하는 과제를 보여주는 이미지.

Python으로 배우는 Gymnasium 기반 Reinforcement Learning

RL 활용 분야

로보틱스
  • 로봇 보행
  • 물체 조작

로봇 손을 보여주는 이미지.

Python으로 배우는 Gymnasium 기반 Reinforcement Learning

RL 활용 분야

로보틱스
  • 로봇 보행
  • 물체 조작

로봇 손을 보여주는 이미지.

금융
  • 트레이딩·투자 최적화
  • 이익 극대화

푸른 배경에 열린 서류가방에서 돈이 쏟아지는 이미지로, 재무적 성공을 표현.

Python으로 배우는 Gymnasium 기반 Reinforcement Learning

RL 활용 분야

자율주행
  • 안전성과 효율성 향상
  • 사고 위험 최소화

도로를 주행하는 여러 자율주행 차량 이미지.

Python으로 배우는 Gymnasium 기반 Reinforcement Learning

RL 활용 분야

자율주행
  • 안전성과 효율성 향상
  • 사고 위험 최소화

도로를 주행하는 여러 자율주행 차량 이미지.

챗봇 개발
  • 대화 능력 향상
  • 사용자 경험 개선

대화형 챗봇을 보여주는 이미지.

Python으로 배우는 Gymnasium 기반 Reinforcement Learning

다음은?

이 강의에서 다룰 내용:

  • RL의 기초와 원리 이해
  • RL 문제를 식별·정의·해결
  • Gymnasium으로 실습

Gymnasium 로고 이미지.

Python으로 배우는 Gymnasium 기반 Reinforcement Learning

연습해 봅시다!

Python으로 배우는 Gymnasium 기반 Reinforcement Learning

Preparing Video For Download...