Przegląd danych głównych
Do tej pory połączyłeś dane ze zbiorów rating i survey z oryginalnym zbiorem danych.
Dodaliśmy do zbioru org_final kilka innych informacji o pracownikach, takich jak compensation, no_leaves_taken (liczba wykorzystanych dni urlopowych), hiring_source i inne. Zapoznaj się z tym zbiorem danych, zanim przejdziesz do inżynierii cech w kolejnym rozdziale.
To ćwiczenie jest częścią kursu
HR Analytics: Przewidywanie rotacji pracowników w R
Instrukcje do ćwiczenia
- Użyj funkcji
glimpse(), aby wyświetlić strukturę zbioru danychorg_final. - Przypisz liczbę zmiennych w zbiorze
org_finaldo zmiennejvariables. - Wygeneruj wykres pudełkowy, który pokaże rozkład wartości
distance_from_homedla pracownikówActiveiInactive.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# View the structure of the dataset
___
# Number of variables in the dataset
variables <- ___
# Compare the travel distance of Active and Inactive employees
ggplot(org_final, aes(x = ___, y = ___)) +
___