开始使用免费开始使用

简单随机抽样

对总体进行抽样的最基础方法就是您已经见过的那种。它称为简单随机抽样(有时缩写为 "SRS"),做法是一次随机抽取一行,每一行被抽到的机会都相同。

为便于观察哪些行进入了样本,建议在抽样前先为数据集添加一列行 ID。

本章将使用 IBM 的一个合成(虚构)员工流失数据集来演示抽样方法,其中 "attrition" 指员工离职。

已提供 attrition_pop;已加载 dplyr

本练习是课程的一部分

R 中的抽样

查看课程

练习说明

  • 查看 attrition_pop 数据集。请在查看器中浏览,直到清楚其包含的内容。
  • 将随机种子设置为您选择的一个值。
  • 为数据集添加行 ID 列,然后使用简单随机抽样获取 200 行。
  • 查看样本数据集 attrition_samp您对行 ID 有什么观察?

交互式实操练习

通过完成这段示例代码来试试这个练习。

# View the attrition_pop dataset
___

# Set the seed
___

attrition_samp <- attrition_pop %>% 
  # Add a row ID column
  ___ %>% 
  # Get 200 rows using simple random sampling
  ___

# View the attrition_samp dataset
___
编辑并运行代码