简单随机抽样
对总体进行抽样的最基础方法就是您已经见过的那种。它称为简单随机抽样(有时缩写为 "SRS"),做法是一次随机抽取一行,每一行被抽到的机会都相同。
为便于观察哪些行进入了样本,建议在抽样前先为数据集添加一列行 ID。
本章将使用 IBM 的一个合成(虚构)员工流失数据集来演示抽样方法,其中 "attrition" 指员工离职。
已提供 attrition_pop;已加载 dplyr。
本练习是课程的一部分
R 中的抽样
练习说明
- 查看
attrition_pop数据集。请在查看器中浏览,直到清楚其包含的内容。 - 将随机种子设置为您选择的一个值。
- 为数据集添加行 ID 列,然后使用简单随机抽样获取 200 行。
- 查看样本数据集
attrition_samp。您对行 ID 有什么观察?
交互式实操练习
通过完成这段示例代码来试试这个练习。
# View the attrition_pop dataset
___
# Set the seed
___
attrition_samp <- attrition_pop %>%
# Add a row ID column
___ %>%
# Get 200 rows using simple random sampling
___
# View the attrition_samp dataset
___