विभाजन मापना: असमानता सूचकांक

Python में US Census डेटा का विश्लेषण

Lee Hachadoorian

Asst. Professor of Instruction, Temple University

विभाजन क्या है?

शिकागो का डॉट डेंसिटी मैप, जिसमें White, Black, Asian, और Hispanic आबादी चार रंगों में दिखी है। एक ही रंग के डॉट साथ-साथ समूहित हैं, जो नस्ल आधारित विभाजन का संकेत देते हैं.

Python में US Census डेटा का विश्लेषण

असमानता सूचकांक का फॉर्मूला

दो समूह A और B दिए हों:

चार खंडों में बँटा एक बॉक्स, प्रत्येक में A और B की आबादी दिखी है.

Python में US Census डेटा का विश्लेषण

असमानता सूचकांक का फॉर्मूला

दो समूह A और B दिए हों:

$$\color{white}{D = {\frac{1}{2}\sum_i}\color{white}{\left\lvert \frac{a_i}{A} - \frac{b_i}{B} \right\rvert}}$$

  • $a_i$ = छोटे क्षेत्र में Group A की संख्या
  • $b_i$ = छोटे क्षेत्र में Group B की संख्या

चार खंडों में बँटा एक बॉक्स, प्रत्येक में A और B की आबादी दिखी है.

Python में US Census डेटा का विश्लेषण

असमानता सूचकांक का फॉर्मूला

दो समूह A और B दिए हों:

$$\color{white}{D = {\frac{1}{2}\sum_i}\color{white}{\left\lvert \frac{a_i}{A} - \frac{b_i}{B} \right\rvert}}$$

  • $a_i$ = छोटे क्षेत्र में Group A की संख्या
  • $b_i$ = छोटे क्षेत्र में Group B की संख्या
  • $A$ = बड़े क्षेत्र में Group A की संख्या
  • $B$ = बड़े क्षेत्र में Group B की संख्या

चार खंडों में बँटा एक बॉक्स, प्रत्येक में A और B की आबादी दिखी है.

Python में US Census डेटा का विश्लेषण

असमानता सूचकांक का फॉर्मूला

दो समूह A और B दिए हों:

$$\color{red}D = \frac{1}{2}\sum_i{\left\lvert \frac{{a_i}}{A} - \frac{b_i}{B} \right\rvert}$$

  • $a_i$ = छोटे क्षेत्र में Group A की संख्या
  • $b_i$ = छोटे क्षेत्र में Group B की संख्या
  • $A$ = बड़े क्षेत्र में Group A की संख्या
  • $B$ = बड़े क्षेत्र में Group B की संख्या

चार खंडों में बँटा एक बॉक्स, प्रत्येक में A और B की आबादी दिखी है.

Python में US Census डेटा का विश्लेषण

असमानता सूचकांक का फॉर्मूला

दो समूह A और B दिए हों:

$$D = \color{white}{\frac{1}{2}\sum_i}\color{white}{\left\lvert \color{red}{\frac{a_i}{A}} \color{white}{- \frac{b_i}{B}} \right\rvert}$$

  • $a_i$ = छोटे क्षेत्र में Group A की संख्या
  • $b_i$ = छोटे क्षेत्र में Group B की संख्या
  • $A$ = बड़े क्षेत्र में Group A की संख्या
  • $B$ = बड़े क्षेत्र में Group B की संख्या

चार खंडों में बँटा एक बॉक्स, प्रत्येक में A और B की आबादी दिखी है.

Python में US Census डेटा का विश्लेषण

असमानता सूचकांक का फॉर्मूला

दो समूह A और B दिए हों:

$$D = \color{white}{\frac{1}{2}\sum_i}\color{white}{\left\lvert \frac{a_i}{A} - \color{red}{\frac{b_i}{B}} \right\rvert}$$

  • $a_i$ = छोटे क्षेत्र में Group A की संख्या
  • $b_i$ = छोटे क्षेत्र में Group B की संख्या
  • $A$ = बड़े क्षेत्र में Group A की संख्या
  • $B$ = बड़े क्षेत्र में Group B की संख्या

चार खंडों में बँटा एक बॉक्स, प्रत्येक में A और B की आबादी दिखी है.

Python में US Census डेटा का विश्लेषण

असमानता सूचकांक का फॉर्मूला

दो समूह A और B दिए हों:

$$D = \color{white}{\frac{1}{2}\sum_i}\color{red}{\left\lvert \frac{a_i}{A} - \frac{b_i}{B} \right\rvert}$$

  • $a_i$ = छोटे क्षेत्र में Group A की संख्या
  • $b_i$ = छोटे क्षेत्र में Group B की संख्या
  • $A$ = बड़े क्षेत्र में Group A की संख्या
  • $B$ = बड़े क्षेत्र में Group B की संख्या

चार खंडों में बँटा एक बॉक्स, प्रत्येक में A और B की आबादी दिखी है.

Python में US Census डेटा का विश्लेषण

असमानता सूचकांक का फॉर्मूला

दो समूह A और B दिए हों:

$$D = \color{white}{\frac{1}{2}}\color{red}{\sum_i}{\left\lvert \frac{a_i}{A} - \frac{b_i}{B} \right\rvert}$$

  • $a_i$ = छोटे क्षेत्र में Group A की संख्या
  • $b_i$ = छोटे क्षेत्र में Group B की संख्या
  • $A$ = बड़े क्षेत्र में Group A की संख्या
  • $B$ = बड़े क्षेत्र में Group B की संख्या

चार खंडों में बँटा एक बॉक्स, प्रत्येक में A और B की आबादी दिखी है.

Python में US Census डेटा का विश्लेषण

असमानता सूचकांक का फॉर्मूला

दो समूह A और B दिए हों:

$$D = \color{red}{\frac{1}{2}}\sum_i{\left\lvert \frac{a_i}{A} - \frac{b_i}{B} \right\rvert}$$

  • $a_i$ = छोटे क्षेत्र में Group A की संख्या
  • $b_i$ = छोटे क्षेत्र में Group B की संख्या
  • $A$ = बड़े क्षेत्र में Group A की संख्या
  • $B$ = बड़े क्षेत्र में Group B की संख्या

चार खंडों में बँटा एक बॉक्स, प्रत्येक में A और B की आबादी दिखी है.

Python में US Census डेटा का विश्लेषण

असमानता सूचकांक का फॉर्मूला

दो समूह A और B दिए हों:

$$D = \frac{1}{2}\sum_i{\left\lvert \frac{a_i}{A} - \frac{b_i}{B} \right\rvert}$$

  • $a_i$ = छोटे क्षेत्र में Group A की संख्या
  • $b_i$ = छोटे क्षेत्र में Group B की संख्या
  • $A$ = बड़े क्षेत्र में Group A की संख्या
  • $B$ = बड़े क्षेत्र में Group B की संख्या

चार खंडों में बँटा एक बॉक्स, प्रत्येक में A और B की आबादी दिखी है.

Python में US Census डेटा का विश्लेषण

उपयुक्त डेटा

tracts.head()
  state county   tract  white  black
0    01    001  020100   1601    217
1    01    001  020200    844   1214
2    01    001  020300   2538    647
3    01    001  020400   4030    191
4    01    001  020500   8438   1418

स्रोत: Table P5 - 2010 Decennial Census

  • white = Nonhispanic White आबादी
  • black = Nonhispanic Black आबादी
Python में US Census डेटा का विश्लेषण

असमानता सूचकांक (D) की गणना

# Extract California tracts using state FIPS "06"
ca_tracts = tracts[tracts["state"] == "06"]

# Define convenience variables to hold column names w = "white" b = "black"
Python में US Census डेटा का विश्लेषण

असमानता सूचकांक (D) की गणना

# Print the sum of Black population for all tracts in California
print(ca_tracts[b].sum())
2163804
# Print the sum of White population for all tracts in California
print(ca_tracts[w].sum())
14956253
Python में US Census डेटा का विश्लेषण

असमानता सूचकांक (D) की गणना

$$D = \frac{1}{2}\sum_i{\left\lvert \frac{a_i}{A} - \frac{b_i}{B} \right\rvert}$$

# Calculate Index of Dissimilarity
print(0.5 * sum(abs(
  ca_tracts[w] / ca_tracts[w].sum() - ca_tracts[b] / ca_tracts[b].sum()
  )))
0.6033425039167011
Python में US Census डेटा का विश्लेषण

अभ्यास करते हैं!

Python में US Census डेटा का विश्लेषण

Preparing Video For Download...