Steg för steg genom permutationen
För att hjälpa dig förstå koden som används för att skapa randomiseringsfördelningen går den här övningen igenom stegen i infer-ramverket ett i taget. Du får bland annat se hur skillnader i de genererade replikaten påverkar de beräknade statistikvärdena.
Efter att du kört infer-stegen, lägg märke till att värdena skiljer sig något mellan varje replikat.
Den här övningen är en del av kursen
Grundläggande inferens i R
Övningsinstruktioner
Paketen dplyr och infer har laddats åt dig, tillsammans med dataramen disc från föregående övning.
- Anropa funktionerna för de tre första stegen. Arbetet är redan gjort åt dig – din uppgift är att undersöka resultaten av de tre första
infer-stegen. - För att se effekten av permutationen,
- gruppera den permuterade dataramen,
disc_perm, efter den nya variabelnreplicate, och sedan - räkna de relevanta variablerna (
promoteinom varjesex) med hjälp avcount().
- gruppera den permuterade dataramen,
- Använd
disc_permochcalculate()för att beräkna statistiken av intresse. Sättstattill"diff in props"ochordertillc("male", "female").
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Replicate the entire data frame, permuting the promote variable
disc_perm <- disc %>%
specify(promote ~ sex, success = "promoted") %>%
hypothesize(null = "independence") %>%
generate(reps = 5, type = "permute")
disc_perm %>%
# Group by replicate
___ %>%
# Count per group
___
disc_perm %>%
# Calculate difference in proportion, male then female
___