Просте випадкове вибіркове дослідження
Найпростіший спосіб відбору з генеральної сукупності — той, який ви вже бачили. Він називається простим випадковим відбором (інколи скорочено «SRS») і передбачає випадкове вибирання рядків по одному, де кожен рядок має таку саму ймовірність бути обраним, як і будь-який інший.
Щоб було легше побачити, які рядки потрапили до вибірки, корисно додати в набір даних стовпець із ідентифікатором рядка перед тим, як робити відбір.
У цьому розділі ми розглянемо методи відбору на синтетичному (вигаданому) наборі даних про плинність кадрів співробітників IBM, де «attrition» означає звільнення з компанії.
attrition_pop доступний; dplyr завантажено.
Ця вправа є частиною курсу
Вибірка в R
Інструкції до вправи
- Перегляньте набір даних
attrition_pop. Дослідіть його у в'ювері, доки не зрозумієте, що саме він містить. - Встановіть випадкове зерно на обране вами значення.
- Додайте стовпець із ID рядка до набору даних, потім застосуйте простий випадковий відбір, щоб отримати 200 рядків.
- Перегляньте вибірковий набір даних
attrition_samp. Що ви помічаєте про ID рядків?
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# View the attrition_pop dataset
___
# Set the seed
___
attrition_samp <- attrition_pop %>%
# Add a row ID column
___ %>%
# Get 200 rows using simple random sampling
___
# View the attrition_samp dataset
___