Začněte nyníZačněte zdarma

Analýza clusterového vzorkování

Spolu se skupinou psychologů se věnuješ analýze duševního zdraví zaměstnanců. Součástí výzkumu je průzkum zaměřený na postoje k duševnímu zdraví na pracovišti v tech sektoru a na frekvenci výskytu duševních potíží mezi tech pracovníky.

Dataset mh_survey obsahuje sloupec gender s pohlavím respondenta, sloupec US_state_live s americkým státem, ve kterém respondent žije, a sloupec sought_treatment s informací o tom, zda respondent vyhledal pomoc s duševním zdravím prostřednictvím svého zaměstnavatele.

Vytvoříš výsečový graf, který znázorní pravděpodobnost, že tech pracovník v USA vyhledá pomoc s duševním zdravím – konkrétně sloupec sought_treatment. Náhodný seznam 10 klastrů států, random_cluster, je už nahraný za tebe.

Pandas a numpy jsou k dispozici jako pd a np.

Toto cvičení je součástí kurzu

Analýza dat z průzkumů v Pythonu

Zobrazit kurz

Pokyny k cvičení

  • Vyfiltruj dataset tak, aby obsahoval pouze státy z random_clusters.
  • Vytvoř výsečový graf ze sloupce sought_treatment.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Subset dataset to inlude only states in cluster_sample
cluster_sample = ____[mh_survey.US_state_live.____(____)]

# Create a pie chart of the sought_treament column
treatment_pie = cluster_sample.____.____(normalize=True)
treatment_pie.____.____()
plt.show()
Upravit a spustit kód