Zacznij terazZacznij za darmo

Przegląd danych głównych

Do tej pory połączyłeś dane ze zbiorów rating i survey z oryginalnym zbiorem danych.

Dodaliśmy do zbioru org_final kilka innych informacji o pracownikach, takich jak compensation, no_leaves_taken (liczba wykorzystanych dni urlopowych), hiring_source i inne. Zapoznaj się z tym zbiorem danych, zanim przejdziesz do inżynierii cech w kolejnym rozdziale.

To ćwiczenie jest częścią kursu

HR Analytics: Przewidywanie rotacji pracowników w R

Zobacz kurs

Instrukcje do ćwiczenia

  • Użyj funkcji glimpse(), aby wyświetlić strukturę zbioru danych org_final.
  • Przypisz liczbę zmiennych w zbiorze org_final do zmiennej variables.
  • Wygeneruj wykres pudełkowy, który pokaże rozkład wartości distance_from_home dla pracowników Active i Inactive.

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

# View the structure of the dataset
___

# Number of variables in the dataset
variables <- ___

# Compare the travel distance of Active and Inactive employees
ggplot(org_final, aes(x = ___, y = ___)) +
  ___
Edytuj i uruchom kod