НачатьНачать бесплатно

Анализ кластерной выборки

Вы вместе с группой психологов исследуете психическое здоровье сотрудников. В рамках исследования проводится опрос, цель которого — изучить отношение к психическому здоровью в сфере технологий и оценить частоту психических расстройств среди IT-специалистов.

Набор данных mh_survey содержит следующие переменные: gender — пол респондента, US_state_live — штат США, в котором он проживает, а также sought_treatment — обращался ли сотрудник за помощью по вопросам психического здоровья через работодателя.

Вы построите круговую диаграмму, чтобы проанализировать вероятность того, что IT-специалист в США обратится за помощью в связи с проблемами психического здоровья (sought_treatment). Список из 10 случайных кластеров штатов — random_cluster — уже загружен для вас.

Библиотеки Pandas и numpy импортированы как pd и np.

Это упражнение является частью курса

Анализ данных опросов на Python

Посмотреть курс

Инструкции к упражнению

  • Отфильтруйте набор данных, оставив только штаты из random_clusters.
  • Постройте круговую диаграмму по столбцу sought_treatment.

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Subset dataset to inlude only states in cluster_sample
cluster_sample = ____[mh_survey.US_state_live.____(____)]

# Create a pie chart of the sought_treament column
treatment_pie = cluster_sample.____.____(normalize=True)
treatment_pie.____.____()
plt.show()
Редактировать и запускать код