ПочатиПочніть безкоштовно

Факторизація, раунд другий

У попередній вправі ви навчилися імпортувати файл даних за допомогою команди read_sav(). Для файлів даних SPSS може трапитися, що деякі змінні, які ви імпортуєте, мають клас labelled. Це зроблено, щоб зберегти всю інформацію про мітки, яка була в оригінальних файлах .sav і .por. Рекомендується перетворювати такі змінні на фактори або інші стандартні класи R.

Дані цієї вправи містять інформацію про працівників та їхні демографічні й економічні характеристики (джерело: QRiE). Дані доступні за таким URL:

https://assets.datacamp.com/production/course_1478/datasets/employee.sav

Ця вправа є частиною курсу

Середній рівень імпорту даних у R

Переглянути курс

Інструкції до вправи

  • Імпортуйте дані SPSS безпосередньо з URL і збережіть отриманий датафрейм як work.
  • Виведіть підсумкову статистику для стовпця GENDER у work. Ця інформація навряд чи корисна, чи не так?
  • Перетворіть стовпець GENDER у work на фактор — клас для позначення категоріальних змінних у R. Використайте as_factor().
  • Ще раз виведіть підсумкову статистику для GENDER. Цього разу результат виглядатиме значно зрозуміліше.

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# haven is already loaded

# Import SPSS data from the URL: work


# Display summary of work$GENDER


# Convert work$GENDER to a factor


# Display summary of work$GENDER again
Редагувати та запускати код