Ручное объединение уровней
В опросе представлены 16 должностей (включая «Other»), которые респонденты могли выбрать. Давайте объединим их в несколько крупных категорий: «Computer Scientist», «Data analyst/scientist/engineer», «Researcher» и «Other». Набор данных multiple_choice_responses уже загружен.
Это упражнение является частью курса
Категориальные данные в Tidyverse
Инструкции к упражнению
- Объедините уровни переменной
CurrentJobTitleSelectв новую переменнуюgrouped_titles. - Затем возьмите
grouped_titlesи поместите всё, что не входит в три перечисленные категории, в «Other Title». - Наконец, подсчитайте количество наблюдений для каждой из полученных категорий.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
multiple_choice_responses %>%
# Create new variable, grouped_titles, by collapsing levels in CurrentJobTitleSelect
___(grouped_titles = ___(CurrentJobTitleSelect,
"Computer Scientist" = c("Programmer", "Software Developer/Software Engineer"),
"Researcher" = "Scientist/Researcher",
"Data Analyst/Scientist/Engineer" = c("DBA/Database Engineer", "Data Scientist",
"Business Analyst", "Data Analyst",
"Data Miner", "Predictive Modeler"))) %>%
# Keep all the new titles and turn every other title into "Other"
___(grouped_titles = ___(grouped_titles,
___ = c("Computer Scientist",
"Researcher",
"Data Analyst/Scientist/Engineer"))) %>%
# Get a count of the grouped titles
___(___)