Kombinationsattack!
Du har nu sett de fyra vanligaste typerna av datamanipulering: sortera rader, välja ut kolumner, filtrera rader och lägga till nya kolumner. I en verklig dataanalys kan du kombinera dessa fyra tekniker för att besvara en mängd olika frågor.
I den här övningen ska du besvara frågan: "Vilken delstat har flest hemlösa per 10 000 invånare?" Använd dina nya pandas-kunskaper för att ta reda på det.
Den här övningen är en del av kursen
Datamanipulering med pandas
Övningsinstruktioner
- Lägg till en kolumn i
homelessnesssom heterindiv_per_10koch som innehåller antalet hemlösa individer per tiotusen invånare i varje delstat – användstate_popför delstatens befolkning. - Filtrera ut de rader där
indiv_per_10kär högre än20och spara resultatet ihigh_homelessness. - Sortera
high_homelessnessi fallande ordning efterindiv_per_10koch spara resultatet ihigh_homelessness_srt. - Välj endast kolumnerna
stateochindiv_per_10kfrånhigh_homelessness_srtoch spara somresult. Titta påresult.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Create indiv_per_10k col as homeless individuals per 10k state pop
homelessness["indiv_per_10k"] = 10000 * ____ / ____
# Subset rows for indiv_per_10k greater than 20
high_homelessness = ____
# Sort high_homelessness by descending indiv_per_10k
high_homelessness_srt = ____
# From high_homelessness_srt, select the state and indiv_per_10k cols
result = ____
# See the result
print(result)