性别歧视的汇总
在任何分析的第一步,您都应先查看并汇总数据。分类变量通常用比例来概括,而且理解该比例的分母始终很重要。
您是要"被晋升的女性所占比例",还是"被晋升者中女性所占比例"?在这里,您需要前者。因此,在 R 代码中必须对变量 sex 使用 group_by()。
歧视研究的数据已在您的工作区中,名为 disc。
本练习是课程的一部分
R 推断基础
练习说明
- 使用
dplyr中的count()函数,列出sex和promote两个变量的联表计数。 - 通过对变量
sex使用group_by()来汇总数据。 - 计算被晋升者所占比例。将该变量命名为
promoted_prop。请注意,对于二元变量,可以使用mean()函数来得到任一取值的比例(例如mean(variable == "value"))。
交互式实操练习
通过完成这段示例代码来试试这个练习。
# Create a contingency table summarizing the data
disc %>%
# Count the rows by sex, promote
___
# Find proportion of each sex who were promoted
disc %>%
# Group by sex
___
# Calculate proportion promoted summary stat
___