Analiza próbkowania skupiskowego
Ty i grupa psychologów chcecie przeanalizować zdrowie psychiczne pracowników. Badanie obejmuje ankietę mierzącą postawy wobec zdrowia psychicznego w branży technologicznej oraz częstotliwość występowania problemów psychicznych wśród pracowników tego sektora.
Zbiór danych mh_survey zawiera kolumnę gender (płeć respondenta), US_state_live (stan USA, w którym mieszka) oraz sought_treatment (czy respondent skorzystał z pomocy pracodawcy w zakresie zdrowia psychicznego).
Stworzysz wykres kołowy, który pomoże ocenić, jak często pracownicy branży technologicznej w USA korzystają z takiej pomocy – zmienna sought_treatment.
Losowa lista 10 klastrów stanów, random_cluster, została już wczytana.
Biblioteki Pandas i numpy są dostępne jako pd i np.
To ćwiczenie jest częścią kursu
Analiza danych ankietowych w Pythonie
Instrukcje do ćwiczenia
- Przefiltruj zbiór danych, aby uwzględniał tylko stany z listy
random_clusters. - Stwórz wykres kołowy dla kolumny
sought_treatment.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Subset dataset to inlude only states in cluster_sample
cluster_sample = ____[mh_survey.US_state_live.____(____)]
# Create a pie chart of the sought_treament column
treatment_pie = cluster_sample.____.____(normalize=True)
treatment_pie.____.____()
plt.show()