逐步完成置换过程
为帮助您理解用于创建随机化分布的代码,本练习将带您逐步走过 infer 框架的步骤。您将看到,生成的各个 replicate 的差异如何影响所计算的统计量。
运行完这些 infer 步骤后,请注意每个 replicate 的数值会略有不同。
本练习是课程的一部分
R 推断基础
练习说明
dplyr 和 infer 包已为您加载,同时还提供了上个练习中的数据框 disc。
- 调用前三个步骤所需的函数。相关代码已为您就绪,您的任务是查看调用
infer的前三个步骤后的结果。 - 为了看到置换的效果:
- 按新的
replicate变量对置换后的数据框disc_perm进行分组,然后 - 使用
count()对关注的变量进行计数(在每个sex内的promote)。
- 按新的
- 使用
disc_perm,用calculate()计算关注的统计量。将stat设为"diff in props",将order设为c("male", "female")。
交互式实操练习
通过完成这段示例代码来试试这个练习。
# Replicate the entire data frame, permuting the promote variable
disc_perm <- disc %>%
specify(promote ~ sex, success = "promoted") %>%
hypothesize(null = "independence") %>%
generate(reps = 5, type = "permute")
disc_perm %>%
# Group by replicate
___ %>%
# Count per group
___
disc_perm %>%
# Calculate difference in proportion, male then female
___