クラスタサンプリングの分析
あなたと心理学者のグループは、従業員のメンタルヘルスの分析に関心があります。リサーチでは、テック業界の職場におけるメンタルヘルスへの態度を測定し、テックワーカーの間でのメンタルヘルス状況の頻度を調べるための調査を行います。
データセット mh_survey には、回答者の gender、居住している米国の州 US_state_live、そして雇用主を通じてメンタルヘルスの治療を受けたかどうか sought_treatment が含まれます。
米国内のテックワーカーがメンタルヘルスに関して治療を受ける可能性(sought_treatment)を分析するため、円グラフを作成します。
10の州クラスタのランダムリスト random_cluster はあらかじめアップロードされています。
Pandas と numpy はそれぞれ pd と np として読み込まれています。
この演習はコースの一部です
Pythonで学ぶアンケートデータ分析
演習の手順
- データセットをサブセット化し、
random_clustersに含まれる州のみを残します。 sought_treatment列の円グラフを作成します。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Subset dataset to inlude only states in cluster_sample
cluster_sample = ____[mh_survey.US_state_live.____(____)]
# Create a pie chart of the sought_treament column
treatment_pie = cluster_sample.____.____(normalize=True)
treatment_pie.____.____()
plt.show()