Beräkna p-värden
I videon lärde du dig att ett p-värde mäter hur mycket data och nollhypotesen avviker från varandra. Här beräknar du p-värdet för den ursprungliga datamängden om könsdiskriminering, samt för de mindre och större versionerna, disc_small och disc_big.
De ursprungliga proportionsskillnaderna finns tillgängliga i din arbetsmiljö som diff_orig, diff_orig_small och diff_orig_big, liksom de permuterade datamängderna disc_perm, disc_perm_small och disc_perm_big.
Kom ihåg att du enbart är intresserad av ett ensidigt hypotestest här. Du försöker med andra ord besvara frågan: "Är män mer sannolika att befordras än kvinnor?"
Den här övningen är en del av kursen
Grundläggande inferens i R
Övningsinstruktioner
- Använd
visualize()ochget_p_value()med de inbyggda funktionerna iinfer. Kom ihåg att nollstatistikerna ligger under den ursprungliga skillnaden, så p-värdet – som representerar hur ofta ett nollvärde är mer extremt – beräknas genom att räkna antalet nollvärden som ärgreaterän den ursprungliga skillnaden. - Upprepa för den lilla datamängden,
disc_perm_small, med observerad skillnaddiff_orig_small. - Upprepa för den stora datamängden,
disc_perm_big, med observerad skillnaddiff_orig_big. - Testa gärna din förståelse genom att prova:
direction = "greater",direction = "two_sided"ochdirection = "less"innan du skickar in ditt svar.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Visualize and calculate the p-value for the original dataset
disc_perm %>%
___(obs_stat = ___, direction = "___")
disc_perm %>%
___(___, ___)
# Visualize and calculate the p-value for the small dataset
___ %>%
___(___, ___)
___ %>%
___(___, ___)
# Visualize and calculate the p-value for the big dataset
___ %>%
___(___, ___)
___ %>%
___(___, ___)