Kom igångKom igång gratis

Steg för steg genom permutationen

För att hjälpa dig förstå koden som används för att skapa randomiseringsfördelningen går den här övningen igenom stegen i infer-ramverket ett i taget. Du får bland annat se hur skillnader i de genererade replikaten påverkar de beräknade statistikvärdena.

Efter att du kört infer-stegen, lägg märke till att värdena skiljer sig något mellan varje replikat.

Den här övningen är en del av kursen

Grundläggande inferens i R

Visa kurs

Övningsinstruktioner

Paketen dplyr och infer har laddats åt dig, tillsammans med dataramen disc från föregående övning.

  • Anropa funktionerna för de tre första stegen. Arbetet är redan gjort åt dig – din uppgift är att undersöka resultaten av de tre första infer-stegen.
  • För att se effekten av permutationen,
    • gruppera den permuterade dataramen, disc_perm, efter den nya variabeln replicate, och sedan
    • räkna de relevanta variablerna (promote inom varje sex) med hjälp av count().
  • Använd disc_perm och calculate() för att beräkna statistiken av intresse. Sätt stat till "diff in props" och order till c("male", "female").

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Replicate the entire data frame, permuting the promote variable
disc_perm <- disc %>%
  specify(promote ~ sex, success = "promoted") %>%
  hypothesize(null = "independence") %>%
  generate(reps = 5, type = "permute")

disc_perm %>%
  # Group by replicate
  ___ %>%
  # Count per group
  ___

disc_perm %>%
  # Calculate difference in proportion, male then female
  ___
Redigera och kör kod