Analýza clusterového vzorkování
Spolu se skupinou psychologů se věnuješ analýze duševního zdraví zaměstnanců. Součástí výzkumu je průzkum zaměřený na postoje k duševnímu zdraví na pracovišti v tech sektoru a na frekvenci výskytu duševních potíží mezi tech pracovníky.
Dataset mh_survey obsahuje sloupec gender s pohlavím respondenta, sloupec US_state_live s americkým státem, ve kterém respondent žije, a sloupec sought_treatment s informací o tom, zda respondent vyhledal pomoc s duševním zdravím prostřednictvím svého zaměstnavatele.
Vytvoříš výsečový graf, který znázorní pravděpodobnost, že tech pracovník v USA vyhledá pomoc s duševním zdravím – konkrétně sloupec sought_treatment.
Náhodný seznam 10 klastrů států, random_cluster, je už nahraný za tebe.
Pandas a numpy jsou k dispozici jako pd a np.
Toto cvičení je součástí kurzu
Analýza dat z průzkumů v Pythonu
Pokyny k cvičení
- Vyfiltruj dataset tak, aby obsahoval pouze státy z
random_clusters. - Vytvoř výsečový graf ze sloupce
sought_treatment.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Subset dataset to inlude only states in cluster_sample
cluster_sample = ____[mh_survey.US_state_live.____(____)]
# Create a pie chart of the sought_treament column
treatment_pie = cluster_sample.____.____(normalize=True)
treatment_pie.____.____()
plt.show()