ÎncepețiÎncepe gratuit

Calcularea D pentru un singur stat

În acest exercițiu vei calcula Indicele de Disimilaritate pentru statul Georgia. Reamintește-ți că formula pentru Indicele de Disimilaritate este:

$$D = \frac{1}{2}\sum{\left\lvert \frac{a}{A} - \frac{b}{B} \right\rvert}$$

În acest caz, Grupul A reprezintă albii, iar Grupul B reprezintă persoanele de culoare. \(a\) și \(b\) reprezintă populația albă, respectiv neagră din geografia de nivel mic (tractele de recensământ), în timp ce \(A\) și \(B\) reprezintă populația albă, respectiv neagră din geografia de nivel mai mare, care le conține (Georgia, cod poștal = GA, cod FIPS = 13).

pandas a fost importat cu aliasul obișnuit, iar DataFrame-ul tracts cu coloanele de populație "white" și "black" a fost încărcat.

Acest exercițiu face parte din cursul

Analiza datelor recensământului SUA în Python

Vezi cursul

Instrucțiuni pentru exercițiu

  • Creează noul DataFrame ga_tracts care să conțină doar tractele din Georgia (coloana "state" trebuie să fie egală cu codul FIPS "13")
  • Furnizează numele coloanelor într-o listă (folosește variabilele w și b) pentru a afișa suma populației albe non-hispanice și a populației negre din Georgia
  • Împarte populația albă din fiecare tract la suma populației albe, apoi scade din rezultat populația neagră din fiecare tract împărțită la suma populației negre; folosește variabilele w și b pentru a îmbunătăți lizibilitatea codului

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

# Define convenience variables to hold column names
w = "white"
b = "black"

# Extract Georgia tracts
ga_tracts = tracts[____]

# Print sums of Black and White residents of Georgia
print(ga_tracts[____].sum())

# Calculate Index of Dissimilarity and print rounded result
D = 0.5 * sum(abs(
  ____ / ____ - ____ / ____))

print("Dissimilarity (Georgia):", round(D, 3))    
Editează și rulează codul