Začněte nyníZačněte zdarma

Generování a výpočet

Pipeline pro testování hypotéz v balíčku infer se skládá ze čtyř kroků pro výpočet nulového rozdělení: specify, hypothesize, generate a calculate.

Pokračujme v pipeline, kterou jsi začal/a v předchozím cvičení. Získáme sadu rozdílů v proporcích rozložených tak, jako by platila nulová hypotéza – tedy že podíl opožděných zásilek je stejný ve všech skupinách podle nákladů na přepravu.

Dataset late_shipments je k dispozici; balíčky dplyr, infer a ggplot2 jsou načteny.

Toto cvičení je součástí kurzu

Testování hypotéz v R

Zobrazit kurz

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Extend the pipeline to generate 2000 permutations
generated <- late_shipments %>% 
  specify(
    late ~ freight_cost_group, 
    success = "Yes"
  ) %>% 
  hypothesize(null = "independence") %>% 
  ___

# See the result
generated
Upravit a spustit kód