시작하기무료로 시작하기

마스터 데이터 개요

지금까지 원래 데이터셋에 ratingsurvey 데이터셋의 정보를 결합했어요.

여기에 compensation, no_leaves_taken(사용한 휴가 일수), hiring_source 등 직원 관련 정보도 추가하여 org_final 데이터셋을 만들었습니다. 다음 장에서 피처 엔지니어링을 진행하기 전에, 먼저 이 데이터셋을 확인해 보세요.

이 연습은 강의의 일부입니다

HR Analytics: R로 직원 이탈 예측하기

강의 보기

연습 안내

  • glimpse()를 사용해 org_final 데이터셋의 구조를 확인하세요.
  • org_final 데이터셋의 변수 개수를 variables에 할당하세요.
  • ActiveInactive 직원의 distance_from_home 분포를 시각화하는 상자 그림(box plot)을 생성하세요.

실습형 인터랙티브 연습

이 예제를 이 샘플 코드를 완성하여 풀어보세요.

# View the structure of the dataset
___

# Number of variables in the dataset
variables <- ___

# Compare the travel distance of Active and Inactive employees
ggplot(org_final, aes(x = ___, y = ___)) +
  ___
코드 편집 및 실행