ПочатиПочніть безкоштовно

Огляд майстер-даних

Досі ви поєднали інформацію з наборів даних rating і survey із вихідним набором.

Ми додали до набору даних org_final ще кілька відомостей про співробітників: compensation, no_leaves_taken (кількість використаних днів відпустки), hiring_source тощо. Перегляньте цей набір даних, перш ніж переходити до створення ознак у наступному розділі.

Ця вправа є частиною курсу

HR Analytics: прогнозування плинності кадрів у R

Переглянути курс

Інструкції до вправи

  • Використайте glimpse(), щоб переглянути структуру набору даних org_final.
  • Присвойте кількість змінних у наборі даних org_final змінній variables.
  • Побудуйте діаграму «ящик з вусами» (box plot), щоб візуалізувати розподіл distance_from_home для співробітників зі статусами Active та Inactive.

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# View the structure of the dataset
___

# Number of variables in the dataset
variables <- ___

# Compare the travel distance of Active and Inactive employees
ggplot(org_final, aes(x = ___, y = ___)) +
  ___
Редагувати та запускати код