Inferență pentru date numerice în R
Mine Cetinkaya-Rundel
Associate Professor of the Practice, Duke University

$H_0$: Scorul mediu de vocabular este același pentru toate clasele sociale, $\mu_{lower} = \mu_{working} = \mu_{middle} = \mu_{upper}$.
$H_A$: Scorurile medii de vocabular diferă pentru cel puțin o pereche de clase sociale.
Variabilitatea totală a scorului de vocabular:
library(broom)
aov(wordsum ~ class, gss) %>%
tidy()
term df sumsq meansq statistic p.value
class 3 236.5644 78.854810 21.73467 0
Residuals 791 2869.8003 3.628066 NA NA
term df sumsq meansq statistic p.value
class 3 236.5644 78.854810 21.73467 0
Residuals 791 2869.8003 3.628066 NA NA
term df sumsq meansq statistic p.value
class 3 236.5644 78.854810 21.73467 0
Residuals 791 2869.8003 3.628066 NA NA
Statistica F = 21.73467 = $\frac{between~group~var}{within~group~var}$

Inferență pentru date numerice în R