Анализ кластерной выборки
Вы вместе с группой психологов исследуете психическое здоровье сотрудников. В рамках исследования проводится опрос, цель которого — изучить отношение к психическому здоровью в сфере технологий и оценить частоту психических расстройств среди IT-специалистов.
Набор данных mh_survey содержит следующие переменные: gender — пол респондента, US_state_live — штат США, в котором он проживает, а также sought_treatment — обращался ли сотрудник за помощью по вопросам психического здоровья через работодателя.
Вы построите круговую диаграмму, чтобы проанализировать вероятность того, что IT-специалист в США обратится за помощью в связи с проблемами психического здоровья (sought_treatment).
Список из 10 случайных кластеров штатов — random_cluster — уже загружен для вас.
Библиотеки Pandas и numpy импортированы как pd и np.
Это упражнение является частью курса
Анализ данных опросов на Python
Инструкции к упражнению
- Отфильтруйте набор данных, оставив только штаты из
random_clusters. - Постройте круговую диаграмму по столбцу
sought_treatment.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Subset dataset to inlude only states in cluster_sample
cluster_sample = ____[mh_survey.US_state_live.____(____)]
# Create a pie chart of the sought_treament column
treatment_pie = cluster_sample.____.____(normalize=True)
treatment_pie.____.____()
plt.show()