Kom igångKom igång gratis

Sammanfatta könsdiskriminering

Som ett första steg i all analys bör du titta på och sammanfatta datan. Kategoriska variabler sammanfattas ofta med proportioner, och det är alltid viktigt att förstå nämnaren i proportionen.

Vill du ha andelen kvinnor som befordrades, eller andelen befordrade som var kvinnor? Här är det det första alternativet som gäller, så i din R-kod behöver du använda group_by() på variabeln sex.

Data från diskrimineringsstudien finns tillgänglig i din arbetsmiljö som disc.

Den här övningen är en del av kursen

Grundläggande inferens i R

Visa kurs

Övningsinstruktioner

  • Använd funktionen count() från dplyr för att tabellera variablerna sex och promote.
  • Sammanfatta datan genom att använda group_by() på variabeln sex.
  • Beräkna andelen som befordrades. Kalla den här variabeln promoted_prop. Observera att för binära variabler kan andelen för något av värdena beräknas med funktionen mean() (t.ex. mean(variable == "value")).

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Create a contingency table summarizing the data
disc %>%
  # Count the rows by sex, promote
  ___

# Find proportion of each sex who were promoted
disc %>%
  # Group by sex
  ___
  # Calculate proportion promoted summary stat
  ___
Redigera och kör kod