시작하기무료로 시작하기

클러스터 그룹화

2016년에 시작되어 진행 중인 한 설문은 기술 업계의 직장 내 정신 건강에 대한 인식을 파악하고, 기술 종사자 사이에서 정신 건강 관련 상태가 얼마나 자주 나타나는지를 조사합니다. 이는 기술 산업 종사자를 대상으로 한 온라인 설문이에요.

데이터셋 mh_survey에는 응답자의 gender, 거주하는 미국 주 US_state_live, 그리고 고용주를 통해 정신 건강 치료를 받은 적이 있는지 여부 sought_treatment가 포함되어 있습니다.

pandasmatplotlib.pylot는 각각 pd, plt로 불러와 두었어요.

이 연습은 강의의 일부입니다

Python으로 설문 데이터 분석하기

강의 보기

연습 안내

  • 모집단을 US_state_live 기준의 클러스터로 그룹화하고 응답자 수를 계산하세요.
  • US_state_live별 응답자 수에 대한 막대 그래프를 그리세요.

실습형 인터랙티브 연습

이 예제를 이 샘플 코드를 완성하여 풀어보세요.

# Group population into clusters and calculate respondents
groups = mh_survey.____(____)[____].____.reset_index()
groups.columns = ['US_state_live','count']

# Plot a bar graph of number of respondents by US_state_live
groups.____.____(____,y='count')
plt.show()
코드 편집 및 실행