Confidence intervals

Python में Sampling

James Chapman

Curriculum Manager, DataCamp

Confidence intervals

  • "मीन से एक standard deviation के भीतर की values" में हर distribution की कई values आती हैं
  • अब हम एक संबंधित कॉन्सेप्ट परिभाषित करेंगे: confidence interval
Python में Sampling

मौसम की भविष्यवाणी

  • संयुक्त राज्य में साउथ डकोटा का रैपिड सिटी सबसे अनिश्चित मौसम वाला स्थान है
  • हमारा काम है वहाँ कल का अधिकतम तापमान प्रेडिक्ट करना

मौसम का मानचित्र, जिसमें रंग क्षेत्र की predictability दिखाते हैं.

Python में Sampling

हमारी मौसम भविष्यवाणी

  • पॉइंट estimate = 47°F (8.3°C)
  • संभावित अधिकतम तापमान की रेंज = 40 से 54°F (4.4 से 12.8°C)
Python में Sampling

हमने अभी एक confidence interval रिपोर्ट किया!

  • 40 से 54°F एक confidence interval है
  • इसे कभी-कभी 47 °F (40°F, 54°F) या 47°F [40°F, 54°F] लिखा जाता है
  • ... या, 47 ± 7°F
  • 7°F है margin of error
Python में Sampling

मीन फ्लेवर का बूटस्ट्रैप डिस्ट्रीब्यूशन

import matplotlib.pyplot as plt
plt.hist(coffee_boot_distn, bins=15)
plt.show()

औसत कॉफ़ी फ्लेवर का histogram.

Python में Sampling

रीसैंपल्स का मीन

import numpy as np
np.mean(coffee_boot_distn)
7.513452892

मीन कॉफ़ी फ्लेवर का histogram, जिसमें मीन एक काली वर्टिकल बार से दिखाया गया है.

Python में Sampling

मीन ± एक standard deviation

np.mean(coffee_boot_distn)
7.513452892
np.mean(coffee_boot_distn) - np.std(coffee_boot_distn, ddof=1)
7.497385709174466
np.mean(coffee_boot_distn) + np.std(coffee_boot_distn, ddof=1)
7.529520074825534

कॉफ़ी फ्लेवर मीन का histogram, जिसमें मीन और standard deviations वर्टिकल बार्स से दिखाए गए हैं.

Python में Sampling

कॉन्फिडेंस इंटरवल के लिए क्वांटाइल मेथड

np.quantile(coffee_boot_distn, 0.025)
7.4817195
np.quantile(coffee_boot_distn, 0.975)
7.5448805

95 प्रतिशत confidence interval की रेखा.

Python में Sampling

इन्वर्स cumulative distribution फंक्शन

  • PDF: बेल कर्व
  • CDF: integrate करके बेल कर्व के नीचे का area निकालें
  • Inv. CDF: x और y अक्ष पलटें

Python में ऐसे implement किया गया है

from scipy.stats import norm
norm.ppf(quantile, loc=0, scale=1)

इन्वर्स cumulative distribution फंक्शन.

Python में Sampling

कॉन्फिडेंस इंटरवल के लिए स्टैंडर्ड एरर मेथड

point_estimate = np.mean(coffee_boot_distn)
7.513452892
std_error = np.std(coffee_boot_distn, ddof=1)
0.016067182825533724
from scipy.stats import norm
lower = norm.ppf(0.025, loc=point_estimate, scale=std_error)
upper = norm.ppf(0.975, loc=point_estimate, scale=std_error)
print((lower, upper))
(7.481961792328933, 7.544943991671067)
Python में Sampling

अभ्यास करते हैं!

Python में Sampling

Preparing Video For Download...