ПочатиПочніть безкоштовно

Просте випадкове вибіркове дослідження

Найпростіший спосіб відбору з генеральної сукупності — той, який ви вже бачили. Він називається простим випадковим відбором (інколи скорочено «SRS») і передбачає випадкове вибирання рядків по одному, де кожен рядок має таку саму ймовірність бути обраним, як і будь-який інший.

Щоб було легше побачити, які рядки потрапили до вибірки, корисно додати в набір даних стовпець із ідентифікатором рядка перед тим, як робити відбір.

У цьому розділі ми розглянемо методи відбору на синтетичному (вигаданому) наборі даних про плинність кадрів співробітників IBM, де «attrition» означає звільнення з компанії.

attrition_pop доступний; dplyr завантажено.

Ця вправа є частиною курсу

Вибірка в R

Переглянути курс

Інструкції до вправи

  • Перегляньте набір даних attrition_pop. Дослідіть його у в'ювері, доки не зрозумієте, що саме він містить.
  • Встановіть випадкове зерно на обране вами значення.
  • Додайте стовпець із ID рядка до набору даних, потім застосуйте простий випадковий відбір, щоб отримати 200 рядків.
  • Перегляньте вибірковий набір даних attrition_samp. Що ви помічаєте про ID рядків?

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# View the attrition_pop dataset
___

# Set the seed
___

attrition_samp <- attrition_pop %>% 
  # Add a row ID column
  ___ %>% 
  # Get 200 rows using simple random sampling
  ___

# View the attrition_samp dataset
___
Редагувати та запускати код