Основы статистического вывода в R
Jo Hardin
Instructor
# Compare confidence intervals
one_poll_boot %>% summarize(
lower = p_hat - 2 *
sd(prop_yes_boot),
upper = p_hat + 2 *
sd(prop_yes_boot))
# A tibble: 1 × 2
lower upper
<dbl> <dbl>
1 0.536148 0.863852
# Find 2.5% and 97.5% of p-hat vals
one_poll_boot %>% summarize(
q025_prop = quantile(prop_yes_boot,
p = .025),
q975_prop = quantile(prop_yes_boot,
p = .975))
# A tibble: 1 × 2
q025_prop q975_prop
<dbl> <dbl>
1 0.5333333 0.8333333
Цель — найти параметр, зная только статистику
Никогда не известно, содержит ли выборка истинное значение параметра
Бутстрап t-ДИ: (0,536; 0,864)
Процентильный интервал: (0,533; 0,833)
Мы на 95% уверены, что истинная доля людей, планирующих голосовать за кандидата X, находится между 0,536 и 0,864 (или между 0,533 и 0,833)
Выборочное распределение статистики достаточно симметрично и имеет колоколообразную форму
Объём выборки достаточно велик
Вариабельность повторных выборочных долей
Основы статистического вывода в R