แนะนำ NHANES และการสุ่มตัวอย่าง

การออกแบบการทดลองใน R

Joanne Xiong

Data Scientist

แนะนำชุดข้อมูล NHANES

NHANES = National Health and Nutrition Examination Survey

  • ดำเนินการโดย National Center for Health Statistics (NCHS) ซึ่งเป็นส่วนหนึ่งของ Centers for Disease Control (CDC)

  • เก็บข้อมูลหลายรูปแบบ ทั้งการสัมภาษณ์และการตรวจร่างกาย

  • ครอบคลุมคำถามด้านการแพทย์ ทันตกรรม เศรษฐกิจสังคม โภชนาการ และสุขภาพทั่วไป

การออกแบบการทดลองใน R

แนะนำการสุ่มตัวอย่าง

การสุ่มตัวอย่างแบบความน่าจะเป็น: ใช้ความน่าจะเป็นในการเลือกตัวอย่าง (หลายรูปแบบ)

การสุ่มตัวอย่างแบบไม่ใช้ความน่าจะเป็น: ไม่ใช้ความน่าจะเป็นในการเลือกตัวอย่าง

  • การตอบสนองโดยสมัครใจ: ผู้ที่ยินดีตอบถือเป็นตัวอย่าง
  • การสุ่มแบบสะดวก: เลือกจากกลุ่มที่เข้าถึงได้ง่ายสำหรับผู้วิจัย
การออกแบบการทดลองใน R

การสุ่มตัวอย่าง - ส่วนที่ 1

Simple Random Sampling (SRS)

  • ทุกหน่วยในประชากรมีโอกาสถูกเลือกเท่ากัน
sample()

Stratified Sampling

  • แบ่งประชากรตามตัวแปรชั้นที่กำหนด
  • สุ่มตัวอย่างแบบ SRS ภายในแต่ละกลุ่มชั้น
dataset %>% 
   group_by(strata_variable) %>% 
   slice_sample()
การออกแบบการทดลองใน R

การสุ่มตัวอย่าง - ส่วนที่ 2

Cluster Sampling

  • แบ่งประชากรออกเป็นกลุ่มที่เรียกว่า cluster
cluster(dataset, 
        cluster_var_name,
        number_to_select,
        method = "option")

Systematic Sampling

  • เลือกตัวอย่างอย่างเป็นระบบ
  • นิยมสร้างฟังก์ชันเองใน R

Multi-stage Sampling

  • ผสมวิธีการสุ่มตัวอย่างตั้งแต่หนึ่งวิธีขึ้นไป
การออกแบบการทดลองใน R

มาฝึกกันเถอะ!

การออกแบบการทดลองใน R

Preparing Video For Download...