ANOVA

R में संख्यात्मक डेटा के लिए Inference

Mine Cetinkaya-Rundel

Associate Professor of the Practice, Duke University

दौड़ाक

R में संख्यात्मक डेटा के लिए Inference

शब्दावली स्कोर बनाम स्व-पहचाने सामाजिक वर्ग के लिए ANOVA

$H_0$: औसत शब्दावली स्कोर सभी सामाजिक वर्गों में समान है, $\mu_{lower} = \mu_{working} = \mu_{middle} = \mu_{upper}$.

$H_A$: कम से कम एक सामाजिक वर्ग-युग्म के बीच औसत शब्दावली स्कोर भिन्न हैं.

R में संख्यात्मक डेटा के लिए Inference

परिवर्तनशीलता का विभाजन

शब्दावली स्कोर में कुल परिवर्तनशीलता:

  • सामाजिक वर्ग के फर्क से समझाई गई परिवर्तनशीलता - बीच-समूह परिवर्तनशीलता
  • अन्य सभी कारकों से आई परिवर्तनशीलता - समूह-के-अंदर परिवर्तनशीलता
R में संख्यात्मक डेटा के लिए Inference

ANOVA आउटपुट

library(broom)

aov(wordsum ~ class, gss) %>%
  tidy()
term        df     sumsq    meansq   statistic p.value
class        3   236.5644  78.854810  21.73467       0
Residuals  791  2869.8003   3.628066        NA      NA
R में संख्यात्मक डेटा के लिए Inference

Sum of squares

term        df     sumsq    meansq   statistic p.value
class        3   236.5644  78.854810  21.73467       0
Residuals  791  2869.8003   3.628066        NA      NA
  • $SST = 236.5644 + 2869.8003 = 3106.365$ - प्रतिक्रिया वैरिएबल में कुल परिवर्तनशीलता को मापता है
  • गणना वैरिएंस जैसी ही होती है (बस सैंपल साइज से स्केल नहीं किया जाता)
  • समझाई गई परिवर्तनशीलता का प्रतिशत = $\frac{236.5644}{3106.365} = 7.6\%$
R में संख्यात्मक डेटा के लिए Inference

F-statistic

term        df     sumsq    meansq   statistic p.value
class        3   236.5644  78.854810  21.73467       0
Residuals  791  2869.8003   3.628066        NA      NA

F-statistic = 21.73467 = $\frac{between~group~var}{within~group~var}$

F-statistic और p-value

R में संख्यात्मक डेटा के लिए Inference

अभ्यास करते हैं!

R में संख्यात्मक डेटा के लिए Inference

Preparing Video For Download...