Slumpmässiga statistikmått och punktdiagram
Genom att permutera variabeln för bostadsägande flera gånger genererar du skillnader i proportioner som är förenliga med antagandet att variablerna är orelaterade. Statistikmåttet av intresse är skillnaden i proportioner, angiven med stat = "diff in props". Efter att ha beräknat de slumpmässiga statistikmåtten plottar du dem i ett punktdiagram.
Den här övningen visar alla fyra steg från paketet infer:
specifyanger respons- och förklaringsvariablerna.hypothesizedeklarerar nollhypotesen.generategenererar återsamplingar, permutationer eller simuleringar.calculateberäknar sammanfattande statistik.
Varje steg behandlas under kursens gång. I den här övningen skriver du kod för calculate().
Paketen dplyr, ggplot2, NHANES och infer är redan inlästa. Upprepa permutationen och plottningen med 100 skillnader i proportioner som genereras genom att blanda variabeln HomeOwn.
Den här övningen är en del av kursen
Grundläggande inferens i R
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Perform 100 permutations
homeown_perm <- homes %>%
specify(HomeOwn ~ Gender, success = "Own") %>%
hypothesize(null = "independence") %>%
generate(reps = 100, type = "permute") %>%
___(___, order = ___)
# Print results to console
homeown_perm