พื้นฐานของ Reinforcement Learning

Reinforcement Learning with Gymnasium ใน Python

Fouad Trad

Machine Learning Engineer

Reinforcement Learning

 

  • Agent เรียนรู้ผ่านการลองผิดลองถูก

 

ภาพแสดงไอคอนสองรายการ ได้แก่ Agent และ Environment

Reinforcement Learning with Gymnasium ใน Python

Reinforcement Learning

 

  • Agent เรียนรู้ผ่านการลองผิดลองถูก

 

ภาพแสดงการที่ Environment ส่ง Observation ให้กับ Agent

Reinforcement Learning with Gymnasium ใน Python

Reinforcement Learning

 

  • Agent เรียนรู้ผ่านการลองผิดลองถูก

 

ภาพแสดงการที่ Environment ส่ง Observation ให้ Agent แล้ว Agent ดำเนินการตาม Action ที่เลือก

Reinforcement Learning with Gymnasium ใน Python

Reinforcement Learning

 

  • Agent เรียนรู้ผ่านการลองผิดลองถูก
  • Agent ได้รับ:
    • รางวัลเมื่อตัดสินใจถูกต้อง
    • บทลงโทษเมื่อตัดสินใจผิดพลาด
  • เป้าหมาย: เพิ่ม Feedback เชิงบวกให้สูงสุดในระยะยาว

 

ภาพแสดงการที่ Environment ส่ง Observation ให้ Agent จากนั้น Agent ดำเนินการ Action และได้รับรางวัลหรือบทลงโทษตามผลของ Action นั้น

Reinforcement Learning with Gymnasium ใน Python

RL เปรียบเหมือนการฝึกสัตว์เลี้ยง

ภาพแสดงชายชราคนหนึ่ง (Environment) กำลังฝึกสัตว์เลี้ยง (Agent)

Reinforcement Learning with Gymnasium ใน Python

RL เทียบกับ ML ประเภทอื่น

ภาพแสดงตารางที่มีหัวข้อ "Supervised Learning" ระบุว่าประเภทข้อมูลคือข้อมูลที่มีป้ายกำกับ เป้าหมายหลักคือการทำนายผลลัพธ์จากข้อมูล Input และเหมาะสำหรับงาน Classification และ Regression

Reinforcement Learning with Gymnasium ใน Python

RL เทียบกับ ML ประเภทอื่น

ภาพแสดงตารางเปรียบเทียบ Supervised Learning และ Unsupervised Learning โดย Supervised Learning ใช้ข้อมูลที่มีป้ายกำกับ มีเป้าหมายเพื่อทำนายผลลัพธ์จากข้อมูล Input เหมาะสำหรับ Classification และ Regression ส่วน Unsupervised Learning ใช้ข้อมูลที่ไม่มีป้ายกำกับ มีเป้าหมายเพื่อค้นหา Pattern หรือความสัมพันธ์ในข้อมูล เหมาะสำหรับ Clustering และการวิเคราะห์ความสัมพันธ์

Reinforcement Learning with Gymnasium ใน Python

RL เทียบกับ ML ประเภทอื่น

ภาพแสดงตารางที่ขยายการเปรียบเทียบโดยรวม RL เข้ากับ Supervised และ Unsupervised Learning โดย Supervised Learning ใช้ข้อมูลที่มีป้ายกำกับเพื่อทำนายผลลัพธ์ เหมาะกับ Classification และ Regression ส่วน Unsupervised Learning ใช้ข้อมูลที่ไม่มีป้ายกำกับเพื่อค้นหา Pattern เหมาะกับ Clustering และการวิเคราะห์ความสัมพันธ์ และ RL ไม่ต้องการข้อมูลฝึกสอนที่กำหนดล่วงหน้า แต่มุ่งเน้นการตัดสินใจเพื่อเพิ่มรางวัลจาก Environment ให้สูงสุด เหมาะสำหรับงานการตัดสินใจ

Reinforcement Learning with Gymnasium ใน Python

เมื่อไรควรใช้ RL?

 

  • การตัดสินใจแบบต่อเนื่อง
    • การตัดสินใจแต่ละครั้งส่งผลต่อ Observation ในอนาคต
  • เรียนรู้ผ่านรางวัลและบทลงโทษ
    • ไม่มีการควบคุมโดยตรง

ไอคอนหุ่นยนต์

Reinforcement Learning with Gymnasium ใน Python

เหมาะกับ RL: การเล่นวิดีโอเกม

  • ผู้เล่นตัดสินใจแบบต่อเนื่อง
  • ได้รับคะแนนหรือเสียชีวิตขึ้นอยู่กับ Action ที่เลือก

ภาพแสดงฉากในวิดีโอเกมที่ Agent กำลังตัดสินใจ

Reinforcement Learning with Gymnasium ใน Python

ไม่เหมาะกับ RL: การจดจำวัตถุในเกม

  • ไม่มีการตัดสินใจแบบต่อเนื่อง
  • ไม่มีการโต้ตอบกับ Environment

ภาพแสดงเฟรมในวิดีโอเกมที่มีเป้าหมายเพื่อจดจำประเภทของ Pokemon

Reinforcement Learning with Gymnasium ใน Python

การประยุกต์ใช้ RL

หุ่นยนต์
  • การเดินของหุ่นยนต์
  • การจัดการวัตถุ

ภาพแสดงมือหุ่นยนต์

Reinforcement Learning with Gymnasium ใน Python

การประยุกต์ใช้ RL

หุ่นยนต์
  • การเดินของหุ่นยนต์
  • การจัดการวัตถุ

ภาพแสดงมือหุ่นยนต์

การเงิน
  • การปรับแต่งกลยุทธ์การซื้อขายและการลงทุน
  • เพิ่มผลกำไรให้สูงสุด

ภาพแสดงเงินจำนวนมากลอยออกจากกระเป๋าเอกสารที่เปิดอยู่บนพื้นหลังสีน้ำเงิน สื่อถึงความสำเร็จทางการเงิน

Reinforcement Learning with Gymnasium ใน Python

การประยุกต์ใช้ RL

ยานยนต์อัตโนมัติ
  • เพิ่มความปลอดภัยและประสิทธิภาพ
  • ลดความเสี่ยงจากอุบัติเหตุ

ภาพแสดงยานยนต์อัตโนมัติหลายคันกำลังขับบนถนน

Reinforcement Learning with Gymnasium ใน Python

การประยุกต์ใช้ RL

ยานยนต์อัตโนมัติ
  • เพิ่มความปลอดภัยและประสิทธิภาพ
  • ลดความเสี่ยงจากอุบัติเหตุ

ภาพแสดงยานยนต์อัตโนมัติหลายคันกำลังขับบนถนน

การพัฒนา Chatbot
  • พัฒนาทักษะการสนทนา
  • ยกระดับประสบการณ์ผู้ใช้

ภาพแสดง Chatbot สำหรับการสนทนา

Reinforcement Learning with Gymnasium ใน Python

ถัดไปคืออะไร?

ในคอร์สนี้จะได้เรียนรู้:

  • ทำความเข้าใจพื้นฐานและหลักการของ RL
  • ระบุ กำหนดกรอบ และแก้ปัญหา RL
  • การประยุกต์ใช้ด้วย Gymnasium

โลโก้ Gymnasium

Reinforcement Learning with Gymnasium ใน Python

มาฝึกกันเถอะ!

Reinforcement Learning with Gymnasium ใน Python

Preparing Video For Download...