Sammanfatta könsdiskriminering
Som ett första steg i all analys bör du titta på och sammanfatta datan. Kategoriska variabler sammanfattas ofta med proportioner, och det är alltid viktigt att förstå nämnaren i proportionen.
Vill du ha andelen kvinnor som befordrades, eller andelen befordrade som var kvinnor? Här är det det första alternativet som gäller, så i din R-kod behöver du använda group_by() på variabeln sex.
Data från diskrimineringsstudien finns tillgänglig i din arbetsmiljö som disc.
Den här övningen är en del av kursen
Grundläggande inferens i R
Övningsinstruktioner
- Använd funktionen
count()fråndplyrför att tabellera variablernasexochpromote. - Sammanfatta datan genom att använda
group_by()på variabelnsex. - Beräkna andelen som befordrades. Kalla den här variabeln
promoted_prop. Observera att för binära variabler kan andelen för något av värdena beräknas med funktionenmean()(t.ex.mean(variable == "value")).
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Create a contingency table summarizing the data
disc %>%
# Count the rows by sex, promote
___
# Find proportion of each sex who were promoted
disc %>%
# Group by sex
___
# Calculate proportion promoted summary stat
___