Рандомізовані статистики та точкова діаграма
Переставляючи змінну володіння житлом кілька разів, ви отримуєте різниці в частках, які узгоджуються з припущенням, що змінні не пов'язані. Потрібна статистика — це різниця в частках, яку задає stat = "diff in props". Після обчислення рандомізованих статистик ви зобразите їх на точковій діаграмі.
Ця вправа демонструє всі чотири кроки з пакета infer:
specifyзадає результативну та пояснювальну змінні.hypothesizeформулює нульову гіпотезу.generateгенерує повторні вибірки, перестановки або моделювання.calculateобчислює підсумкові статистики.
Кожен крок буде розглянуто впродовж курсу; у цій вправі ви напишете код для calculate().
Пакети dplyr, ggplot2, NHANES та infer уже підключені. Повторіть перестановки та побудову графіка для 100 різниць у частках, згенерованих випадковим перемішуванням змінної HomeOwn.
Ця вправа є частиною курсу
Основи інференції в R
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Perform 100 permutations
homeown_perm <- homes %>%
specify(HomeOwn ~ Gender, success = "Own") %>%
hypothesize(null = "independence") %>%
generate(reps = 100, type = "permute") %>%
___(___, order = ___)
# Print results to console
homeown_perm