НачатьНачать бесплатно

Пошаговый разбор перестановки

Это упражнение поможет вам разобраться в коде, который используется для построения распределения рандомизации. Вы пройдёте через каждый шаг фреймворка infer и увидите, как различия между сгенерированными репликами влияют на вычисляемые статистики.

После выполнения шагов infer обратите внимание на то, что числа немного отличаются для каждой реплики.

Это упражнение является частью курса

Основы статистического вывода в R

Посмотреть курс

Инструкции к упражнению

Пакеты dplyr и infer уже загружены, как и фрейм данных disc из предыдущего упражнения.

  • Вызовите функции для первых трёх шагов. Основная работа уже выполнена — ваша задача состоит в том, чтобы изучить результаты первых трёх шагов infer.
  • Чтобы увидеть эффект перестановки:
    • сгруппируйте переставленный фрейм данных disc_perm по новой переменной replicate, затем
    • подсчитайте интересующие переменные (promote внутри каждой группы sex) с помощью count().
  • Используя disc_perm, вычислите интересующую статистику с помощью calculate(). Задайте stat значение "diff in props", а order — значение c("male", "female").

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Replicate the entire data frame, permuting the promote variable
disc_perm <- disc %>%
  specify(promote ~ sex, success = "promoted") %>%
  hypothesize(null = "independence") %>%
  generate(reps = 5, type = "permute")

disc_perm %>%
  # Group by replicate
  ___ %>%
  # Count per group
  ___

disc_perm %>%
  # Calculate difference in proportion, male then female
  ___
Редактировать и запускать код