Перекодирование тем
Осталось ещё одно шаг очистки данных, чтобы сделать их более понятными. Сейчас темы обозначены двухбуквенными кодами:
- me: Палестинский конфликт
- nu: Ядерное оружие и ядерные материалы
- di: Контроль над вооружениями и разоружение
- hr: Права человека
- co: Колониализм
- ec: Экономическое развитие
Чтобы упростить интерпретацию данных, перекодируйте их: замените коды полными названиями. Для этого используйте функцию recode() из пакета dplyr, которая заменяет значения на указанные вами:
example <- c("apple", "banana", "apple", "orange")
recode(example,
apple = "plum",
banana = "grape")
Это упражнение является частью курса
Практический пример: разведочный анализ данных в R
Инструкции к упражнению
Используйте функцию recode() из пакета dplyr внутри mutate(), чтобы заменить каждый двухбуквенный код в наборе данных votes_gathered соответствующим полным названием. Сохраните результат в переменную votes_tidied.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Replace the two-letter codes in topic: votes_tidied
votes_tidied <- ___ %>%
mutate(topic = recode(___,
___ = "Palestinian conflict",
___ = "Nuclear weapons and nuclear material",
___ = "Arms control and disarmament",
___ = "Human rights",
___ = "Colonialism",
___ = "Economic development"))