Analiza eșantionării prin clustere
Tu și un grup de psihologi doriți să analizați sănătatea mintală a angajaților. Cercetarea voastră include un sondaj care urmărește să măsoare atitudinile față de sănătatea mintală la locul de muncă în domeniul tech și să examineze frecvența problemelor de sănătate mintală în rândul acestor angajați.
Setul de date mh_survey include gender (genul respondentului), statul american în care locuiește, US_state_live, și dacă a apelat la tratament pentru sănătatea mintală prin intermediul angajatorului, sought_treatment.
Vei crea o diagramă circulară pentru a analiza probabilitatea ca un angajat din domeniul tech să apeleze la tratament pentru sănătatea mintală în SUA, coloana sought_treatment.
O listă aleatorie cu 10 clustere de state, random_cluster, a fost deja încărcată pentru tine.
Pandas și numpy au fost încărcate ca pd și np.
Acest exercițiu face parte din cursul
Analiza datelor din sondaje în Python
Instrucțiuni pentru exercițiu
- Filtrează setul de date pentru a include doar statele din
random_clusters. - Creează o diagramă circulară a coloanei
sought_treatment.
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Subset dataset to inlude only states in cluster_sample
cluster_sample = ____[mh_survey.US_state_live.____(____)]
# Create a pie chart of the sought_treament column
treatment_pie = cluster_sample.____.____(normalize=True)
treatment_pie.____.____()
plt.show()