Комбинированная атака!
Вы уже познакомились с четырьмя основными типами операций с данными: сортировкой строк, выбором столбцов, фильтрацией строк и добавлением новых столбцов. В реальном анализе данных эти операции можно комбинировать в любом порядке, чтобы ответить на самые разные вопросы.
В этом упражнении вы ответите на вопрос: «В каком штате наибольшее число бездомных на 10 000 жителей?» Используйте полученные навыки работы с pandas, чтобы найти ответ.
Это упражнение является частью курса
Работа с данными в pandas
Инструкции к упражнению
- Добавьте в таблицу
homelessnessстолбецindiv_per_10k, содержащий количество бездомных на десять тысяч жителей каждого штата. Для расчёта используйте столбецstate_popс численностью населения. - Отфильтруйте строки, в которых
indiv_per_10kбольше20, и сохраните результат в переменнуюhigh_homelessness. - Отсортируйте
high_homelessnessпо убыванию значенийindiv_per_10kи сохраните результат в переменнуюhigh_homelessness_srt. - Выберите только столбцы
stateиindiv_per_10kизhigh_homelessness_srtи сохраните результат в переменнуюresult. Изучите содержимоеresult.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Create indiv_per_10k col as homeless individuals per 10k state pop
homelessness["indiv_per_10k"] = 10000 * ____ / ____
# Subset rows for indiv_per_10k greater than 20
high_homelessness = ____
# Sort high_homelessness by descending indiv_per_10k
high_homelessness_srt = ____
# From high_homelessness_srt, select the state and indiv_per_10k cols
result = ____
# See the result
print(result)