Beräkna D för en delstat
I den här övningen beräknar du dissimilaritetsindexet (Index of Dissimilarity) för delstaten Georgia. Kom ihåg att formeln är:
$$D = \frac{1}{2}\sum{\left\lvert \frac{a}{A} - \frac{b}{B} \right\rvert}$$
Här utgör grupp A vita och grupp B svarta. \(a\) och \(b\) representerar den vita och svarta befolkningen i den lilla geografiska enheten (census tracts), medan \(A\) och \(B\) representerar den vita och svarta befolkningen i den större, övergripande geografin (Georgia, postkod = GA, FIPS-kod = 13).
pandas har importerats med det vanliga aliaset, och DataFramen tracts med befolkningskolumnerna "white" och "black" har laddats in.
Den här övningen är en del av kursen
Analys av amerikansk folkräkningsdata i Python
Övningsinstruktioner
- Skapa den nya DataFramen
ga_tractsmed enbart de tracts som tillhör Georgia (kolumnen"state"ska vara lika med FIPS-koden"13") - Ange kolumnnamnen i en lista (använd variablerna
wochb) för att skriva ut summan av icke-hispaniska vita och svarta i Georgia - Ta den vita befolkningen i varje tract dividerat med summan av den vita befolkningen, och subtrahera den svarta befolkningen i varje tract dividerat med summan av den svarta befolkningen; använd variablerna
wochbför att öka kodens läsbarhet
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Define convenience variables to hold column names
w = "white"
b = "black"
# Extract Georgia tracts
ga_tracts = tracts[____]
# Print sums of Black and White residents of Georgia
print(ga_tracts[____].sum())
# Calculate Index of Dissimilarity and print rounded result
D = 0.5 * sum(abs(
____ / ____ - ____ / ____))
print("Dissimilarity (Georgia):", round(D, 3))