ช่วงความเชื่อมั่นและการสุ่มตัวอย่าง

พื้นฐานการอนุมานทางสถิติด้วย Python

Paul Savala

Assistant Professor of Mathematics

ช่วงความเชื่อมั่นคืออะไร?

  • ใช้ตัวอย่างเพื่อสร้างช่วงของค่า
  • ช่วงของค่าประมาณค่าสถิติของประชากร

ตัวอย่าง:

  • ตัวอย่างพนักงาน 100 คน
  • เงินเดือนเฉลี่ย $80,000
  • ส่วนเบี่ยงเบนมาตรฐาน $10,000

ช่วงความเชื่อมั่นที่มีค่า 78,040 ดอลลาร์ทางซ้าย 81,959 ดอลลาร์ทางขวา และ 80,000 ดอลลาร์ตรงกลาง

พื้นฐานการอนุมานทางสถิติด้วย Python

การคำนวณช่วงความเชื่อมั่น

from scipy import stats
import numpy as np


ci = stats.norm.interval(loc=80000, # Mean
scale=10000/np.sqrt(100), # Standard error
alpha=0.95) # Confidence level
print(ci)
(78040.04, 81959.96)

การอนุมานที่ถูกต้องต้องใช้การแจกแจงแบบปกติของตัวอย่าง

พื้นฐานการอนุมานทางสถิติด้วย Python

ทฤษฎีบทขีดจำกัดกลาง

  • เฉลี่ยตัวอย่างอิสระหลายชุด
  • การแจกแจงของตัวอย่างจะเข้าใกล้การแจกแจงแบบปกติ
population = [0, 1, 2, 3, 4, 5, 6, 7, 8, 9]
sample_means = []

for i in range(1000):
sample_5 = np.random.choice(population, size=5)
sample_means.append(sample_5.mean())
พื้นฐานการอนุมานทางสถิติด้วย Python
plt.hist(sample_means)

ฮิสโทแกรมที่แกน x แสดง "ค่าเฉลี่ยของตัวอย่าง" แกน y แสดง "จำนวนครั้ง" หัวข้อคือ "การแจกแจงของตัวอย่าง" และฮิสโทแกรมมีลักษณะใกล้เคียงการแจกแจงแบบปกติที่มีศูนย์กลางที่ห้า

พื้นฐานการอนุมานทางสถิติด้วย Python

เมืองใหญ่ที่มีทั้งตึกสูงและบ้านเรือนเก่าทรุดโทรม

พื้นฐานการอนุมานทางสถิติด้วย Python

ช่วงความเชื่อมั่นบอกเราว่าอะไร

(และสิ่งที่ไม่ได้บอก)

  • ค่าสถิติของประชากรอาจอยู่หรือไม่อยู่ในช่วงความเชื่อมั่น
  • การสุ่มตัวอย่างซ้ำหลายครั้ง -> 95% ของช่วงความเชื่อมั่นจะครอบคลุมค่าสถิติของประชากร
พื้นฐานการอนุมานทางสถิติด้วย Python

มาฝึกกันเถอะ!

พื้นฐานการอนุมานทางสถิติด้วย Python

Preparing Video For Download...