手动合并水平
问卷中共有 16 个可选的职位名称(包含 "Other")。我们把它们合并为几个大类:"Computer Scientist"、"Data analyst/scientist/engineer"、"Researcher" 和 "Other"。数据集 multiple_choice_responses 已为您加载。
本练习是课程的一部分
Tidyverse 中的分类数据
练习说明
- 将
CurrentJobTitleSelect的水平合并为一个新变量grouped_titles。 - 然后基于
grouped_titles,把不属于上述三个合并后职位名称的全部归为 "Other Title"。 - 最后,统计所有合并后职位名称的计数。
交互式实操练习
通过完成这段示例代码来试试这个练习。
multiple_choice_responses %>%
# Create new variable, grouped_titles, by collapsing levels in CurrentJobTitleSelect
___(grouped_titles = ___(CurrentJobTitleSelect,
"Computer Scientist" = c("Programmer", "Software Developer/Software Engineer"),
"Researcher" = "Scientist/Researcher",
"Data Analyst/Scientist/Engineer" = c("DBA/Database Engineer", "Data Scientist",
"Business Analyst", "Data Analyst",
"Data Miner", "Predictive Modeler"))) %>%
# Keep all the new titles and turn every other title into "Other"
___(grouped_titles = ___(grouped_titles,
___ = c("Computer Scientist",
"Researcher",
"Data Analyst/Scientist/Engineer"))) %>%
# Get a count of the grouped titles
___(___)