Kom igångKom igång gratis

Kombinationsattack!

Du har nu sett de fyra vanligaste typerna av datamanipulering: sortera rader, välja ut kolumner, filtrera rader och lägga till nya kolumner. I en verklig dataanalys kan du kombinera dessa fyra tekniker för att besvara en mängd olika frågor.

I den här övningen ska du besvara frågan: "Vilken delstat har flest hemlösa per 10 000 invånare?" Använd dina nya pandas-kunskaper för att ta reda på det.

Den här övningen är en del av kursen

Datamanipulering med pandas

Visa kurs

Övningsinstruktioner

  • Lägg till en kolumn i homelessness som heter indiv_per_10k och som innehåller antalet hemlösa individer per tiotusen invånare i varje delstat – använd state_pop för delstatens befolkning.
  • Filtrera ut de rader där indiv_per_10k är högre än 20 och spara resultatet i high_homelessness.
  • Sortera high_homelessness i fallande ordning efter indiv_per_10k och spara resultatet i high_homelessness_srt.
  • Välj endast kolumnerna state och indiv_per_10k från high_homelessness_srt och spara som result. Titta på result.

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Create indiv_per_10k col as homeless individuals per 10k state pop
homelessness["indiv_per_10k"] = 10000 * ____ / ____ 

# Subset rows for indiv_per_10k greater than 20
high_homelessness = ____

# Sort high_homelessness by descending indiv_per_10k
high_homelessness_srt = ____

# From high_homelessness_srt, select the state and indiv_per_10k cols
result = ____

# See the result
print(result)
Redigera och kör kod