Факторизація, раунд другий
У попередній вправі ви навчилися імпортувати файл даних за допомогою команди read_sav(). Для файлів даних SPSS може трапитися, що деякі змінні, які ви імпортуєте, мають клас labelled. Це зроблено, щоб зберегти всю інформацію про мітки, яка була в оригінальних файлах .sav і .por. Рекомендується перетворювати такі змінні на фактори або інші стандартні класи R.
Дані цієї вправи містять інформацію про працівників та їхні демографічні й економічні характеристики (джерело: QRiE). Дані доступні за таким URL:
https://assets.datacamp.com/production/course_1478/datasets/employee.sav
Ця вправа є частиною курсу
Середній рівень імпорту даних у R
Інструкції до вправи
- Імпортуйте дані SPSS безпосередньо з URL і збережіть отриманий датафрейм як
work. - Виведіть підсумкову статистику для стовпця
GENDERуwork. Ця інформація навряд чи корисна, чи не так? - Перетворіть стовпець
GENDERуworkна фактор — клас для позначення категоріальних змінних у R. Використайтеas_factor(). - Ще раз виведіть підсумкову статистику для
GENDER. Цього разу результат виглядатиме значно зрозуміліше.
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# haven is already loaded
# Import SPSS data from the URL: work
# Display summary of work$GENDER
# Convert work$GENDER to a factor
# Display summary of work$GENDER again