Atak kombinowany!
Poznałeś już cztery najczęstsze typy manipulacji na danych: sortowanie wierszy, wybieranie kolumn, filtrowanie wierszy i dodawanie nowych kolumn. W prawdziwej analizie danych możesz łączyć te cztery operacje na różne sposoby, by odpowiadać na wiele różnych pytań.
W tym ćwiczeniu odpowiesz na pytanie: „Który stan ma największą liczbę bezdomnych na 10 000 mieszkańców?". Wykorzystaj zdobyte umiejętności pandas, by to sprawdzić.
To ćwiczenie jest częścią kursu
Manipulacja danymi z pandas
Instrukcje do ćwiczenia
- Dodaj do
homelessnesskolumnęindiv_per_10kzawierającą liczbę bezdomnych na dziesięć tysięcy mieszkańców każdego stanu – użyj kolumnystate_popjako populacji stanu. - Wybierz wiersze, w których wartość
indiv_per_10kjest wyższa niż20, i przypisz wynik dohigh_homelessness. - Posortuj
high_homelessnessmalejąco wedługindiv_per_10ki przypisz wynik dohigh_homelessness_srt. - Wybierz tylko kolumny
stateiindiv_per_10kzhigh_homelessness_srti zapisz jakoresult. Przyjrzyj się zmiennejresult.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Create indiv_per_10k col as homeless individuals per 10k state pop
homelessness["indiv_per_10k"] = 10000 * ____ / ____
# Subset rows for indiv_per_10k greater than 20
high_homelessness = ____
# Sort high_homelessness by descending indiv_per_10k
high_homelessness_srt = ____
# From high_homelessness_srt, select the state and indiv_per_10k cols
result = ____
# See the result
print(result)