Обсяг вибірки у розподілі рандомізації
Ми підготували для вас два нові набори даних із по суті такою самою різницею часток, як і в початкових даних про дискримінацію. Однак один із них (disc_small) має третину розміру початкового набору, а інший (disc_big) у 10 разів більший за початковий.
Крім того, той самий код перестановок, який ви використовували раніше, було запущено для малого та великого наборів даних, щоб отримати малі та великі розподіли переставлених різниць у рівнях підвищення (disc_small_perm і disc_big_perm відповідно).
У цій вправі ви використаєте ці два нові розподіли, щоб побачити, як відрізняються значення за дуже різних обсягів вибірки. Зверніть увагу насамперед на діапазон мінливості вздовж осі x на кожному графіку.
Ця вправа є частиною курсу
Основи інференції в R
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Tabulate the small dataset
disc_small %>%
# Select sex and promote
___(___, ___)
# Do the same for disc_big
___