Kom igångKom igång gratis

Analys med klustersampling

Du och en grupp psykologer vill analysera anställdas psykiska hälsa. Er forskning omfattar en enkät som syftar till att mäta attityder kring psykisk hälsa på teknikarbetsplatser och undersöka hur vanliga psykiska besvär är bland teknikarbetare.

Datamängden mh_survey innehåller respondenternas kön (gender), den delstat i USA de bor i (US_state_live), samt om de har sökt behandling för sin psykiska hälsa via sin arbetsgivare (sought_treatment).

Du ska skapa ett cirkeldiagram för att analysera hur troligt det är att en teknikarbetare i USA söker behandling för sin psykiska hälsa (sought_treatment). En slumpmässig lista med 10 delstatkluster, random_cluster, har laddats upp åt dig.

Pandas och numpy har laddats upp som pd respektive np.

Den här övningen är en del av kursen

Analysera enkätdata med Python

Visa kurs

Övningsinstruktioner

  • Filtrera datamängden så att den endast innehåller delstater som finns i random_clusters.
  • Skapa ett cirkeldiagram över kolumnen sought_treatment.

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Subset dataset to inlude only states in cluster_sample
cluster_sample = ____[mh_survey.US_state_live.____(____)]

# Create a pie chart of the sought_treament column
treatment_pie = cluster_sample.____.____(normalize=True)
treatment_pie.____.____()
plt.show()
Redigera och kör kod