마스터 데이터 개요
지금까지 원래 데이터셋에 rating과 survey 데이터셋의 정보를 결합했어요.
여기에 compensation, no_leaves_taken(사용한 휴가 일수), hiring_source 등 직원 관련 정보도 추가하여 org_final 데이터셋을 만들었습니다. 다음 장에서 피처 엔지니어링을 진행하기 전에, 먼저 이 데이터셋을 확인해 보세요.
이 연습은 강의의 일부입니다
HR Analytics: R로 직원 이탈 예측하기
연습 안내
glimpse()를 사용해org_final데이터셋의 구조를 확인하세요.org_final데이터셋의 변수 개수를variables에 할당하세요.Active와Inactive직원의distance_from_home분포를 시각화하는 상자 그림(box plot)을 생성하세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# View the structure of the dataset
___
# Number of variables in the dataset
variables <- ___
# Compare the travel distance of Active and Inactive employees
ggplot(org_final, aes(x = ___, y = ___)) +
___