R로 하는 가설 검정
Richie Cotton
Data Evangelist at DataCamp
표본은 더 큰 모집단에서 무작위로 추출된 부분집합입니다.

데이터셋의 각 관측값(행)은 독립적입니다.
표본은 불확실성을 줄이고 중심극한정리가 적용될 만큼 충분히 커야 합니다.
$n \ge 30$
$n$: 표본 크기
$n_{1} \ge 30, n_{2} \ge 30$
$n_{i}$: 그룹 $i$의 표본 크기
데이터의 행 수 $\ge 30$
$n_{i} \ge 30$ (모든 $i$에 대해)
$n \times \hat{p} \ge 10$
$n \times (1 - \hat{p}) \ge 10$
$n$: 표본 크기
$\hat{p}$: 표본 내 성공 비율
$n_{1} \times \hat{p}_{1} \ge 10$
$n_{2} \times \hat{p}_{2} \ge 10$
$n_{1} \times (1 - \hat{p}_{1}) \ge 10$
$n_{2} \times (1 - \hat{p}_{2}) \ge 10$
$n_{i} \times \hat{p}_{i} \ge 5$ (모든 $i$에 대해)
$n_{i} \times (1 - \hat{p}_{i}) \ge 5$ (모든 $i$에 대해)
$n_{i}$: 그룹 $i$의 표본 크기
$\hat{p}_{i}$: 표본 그룹 $i$의 성공 비율
부트스트랩 분포가 정규분포처럼 보이지 않는다면, 가정이 충족되지 않은 것입니다.
R로 하는 가설 검정