ПочатиПочніть безкоштовно

Рандомізовані статистики та точкова діаграма

Переставляючи змінну володіння житлом кілька разів, ви отримуєте різниці в частках, які узгоджуються з припущенням, що змінні не пов'язані. Потрібна статистика — це різниця в частках, яку задає stat = "diff in props". Після обчислення рандомізованих статистик ви зобразите їх на точковій діаграмі.

Ця вправа демонструє всі чотири кроки з пакета infer:

  • specify задає результативну та пояснювальну змінні.
  • hypothesize формулює нульову гіпотезу.
  • generate генерує повторні вибірки, перестановки або моделювання.
  • calculate обчислює підсумкові статистики.

Кожен крок буде розглянуто впродовж курсу; у цій вправі ви напишете код для calculate().

Пакети dplyr, ggplot2, NHANES та infer уже підключені. Повторіть перестановки та побудову графіка для 100 різниць у частках, згенерованих випадковим перемішуванням змінної HomeOwn.

Ця вправа є частиною курсу

Основи інференції в R

Переглянути курс

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# Perform 100 permutations
homeown_perm <- homes %>%
  specify(HomeOwn ~ Gender, success = "Own") %>%
  hypothesize(null = "independence") %>% 
  generate(reps = 100, type = "permute") %>% 
  ___(___, order = ___)
  
# Print results to console
homeown_perm
Редагувати та запускати код