Рандомизированные статистики и точечная диаграмма
Многократно переставляя значения переменной домовладения, вы получаете разности пропорций, согласующиеся с предположением о том, что переменные не связаны между собой. Интересующая нас статистика — это разность пропорций, задаваемая параметром stat = "diff in props". После вычисления рандомизированных статистик вы отобразите их на точечной диаграмме.
В этом упражнении задействованы все четыре шага из пакета infer:
specifyзадаёт зависимую и объясняющую переменные.hypothesizeобъявляет нулевую гипотезу.generateгенерирует повторные выборки, перестановки или симуляции.calculateвычисляет сводные статистики.
Каждый шаг будет подробно рассмотрен в ходе курса; в этом упражнении вам нужно написать код для calculate().
Пакеты dplyr, ggplot2, NHANES и infer уже загружены. Повторите перестановки и постройте график, сгенерировав 100 разностей пропорций путём перемешивания переменной HomeOwn.
Это упражнение является частью курса
Основы статистического вывода в R
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Perform 100 permutations
homeown_perm <- homes %>%
specify(HomeOwn ~ Gender, success = "Own") %>%
hypothesize(null = "independence") %>%
generate(reps = 100, type = "permute") %>%
___(___, order = ___)
# Print results to console
homeown_perm