Перевірка гіпотез у R
Richie Cotton
Data Evangelist at DataCamp
Вибірки — це випадкові підмножини більших генеральних сукупностей.

Кожне спостереження (рядок) у наборі даних є незалежним.
Вибірка достатньо велика, щоб зменшити невизначеність і щоб діяв центральний граничний теорем.
$n \ge 30$
$n$: обсяг вибірки
$n_{1} \ge 30, n_{2} \ge 30$
$n_{i}$: обсяг вибірки для групи $i$
Кількість рядків у ваших даних $\ge 30$
$n_{i} \ge 30$ для всіх значень $i$
$n \times \hat{p} \ge 10$
$n \times (1 - \hat{p}) \ge 10$
$n$: обсяг вибірки
$\hat{p}$: частка успіхів у вибірці
$n_{1} \times \hat{p}_{1} \ge 10$
$n_{2} \times \hat{p}_{2} \ge 10$
$n_{1} \times (1 - \hat{p}_{1}) \ge 10$
$n_{2} \times (1 - \hat{p}_{2}) \ge 10$
$n_{i} \times \hat{p}_{i} \ge 5$ для всіх значень $i$
$n_{i} \times (1 - \hat{p}_{i}) \ge 5$ для всіх значень $i$
$n_{i}$: обсяг вибірки для групи $i$
$\hat{p}_{i}$: частка успіхів у вибірці групи $i$
Якщо бутстреп-розподіл не виглядає нормальним, припущення, ймовірно, не виконуються.
Перевірка гіпотез у R