ПочатиПочніть безкоштовно

Обсяг вибірки у розподілі рандомізації

Ми підготували для вас два нові набори даних із по суті такою самою різницею часток, як і в початкових даних про дискримінацію. Однак один із них (disc_small) має третину розміру початкового набору, а інший (disc_big) у 10 разів більший за початковий.

Крім того, той самий код перестановок, який ви використовували раніше, було запущено для малого та великого наборів даних, щоб отримати малі та великі розподіли переставлених різниць у рівнях підвищення (disc_small_perm і disc_big_perm відповідно).

У цій вправі ви використаєте ці два нові розподіли, щоб побачити, як відрізняються значення за дуже різних обсягів вибірки. Зверніть увагу насамперед на діапазон мінливості вздовж осі x на кожному графіку.

Ця вправа є частиною курсу

Основи інференції в R

Переглянути курс

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# Tabulate the small dataset
disc_small %>% 
  # Select sex and promote
  ___(___, ___)
  
# Do the same for disc_big
___
Редагувати та запускати код