НачатьНачать бесплатно

Рандомизированные статистики и точечная диаграмма

Многократно переставляя значения переменной домовладения, вы получаете разности пропорций, согласующиеся с предположением о том, что переменные не связаны между собой. Интересующая нас статистика — это разность пропорций, задаваемая параметром stat = "diff in props". После вычисления рандомизированных статистик вы отобразите их на точечной диаграмме.

В этом упражнении задействованы все четыре шага из пакета infer:

  • specify задаёт зависимую и объясняющую переменные.
  • hypothesize объявляет нулевую гипотезу.
  • generate генерирует повторные выборки, перестановки или симуляции.
  • calculate вычисляет сводные статистики.

Каждый шаг будет подробно рассмотрен в ходе курса; в этом упражнении вам нужно написать код для calculate().

Пакеты dplyr, ggplot2, NHANES и infer уже загружены. Повторите перестановки и постройте график, сгенерировав 100 разностей пропорций путём перемешивания переменной HomeOwn.

Это упражнение является частью курса

Основы статистического вывода в R

Посмотреть курс

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Perform 100 permutations
homeown_perm <- homes %>%
  specify(HomeOwn ~ Gender, success = "Own") %>%
  hypothesize(null = "independence") %>% 
  generate(reps = 100, type = "permute") %>% 
  ___(___, order = ___)
  
# Print results to console
homeown_perm
Редактировать и запускать код