Shrnutí studie o genderové diskriminaci
Prvním krokem každé analýzy je prohlédnout si data a shrnout je. Kategoriální proměnné se často popisují pomocí proporcí – a vždy je důležité vědět, k čemu se proporce vztahuje.
Zajímá tě podíl žen, které byly povýšeny, nebo podíl povýšených osob, které jsou ženy? Tady chceme to první, takže v R kódu je potřeba použít group_by() na proměnnou sex.
Data ze studie o diskriminaci jsou v tvém prostředí dostupná jako disc.
Toto cvičení je součástí kurzu
Základy statistické inference v R
Pokyny k cvičení
- Pomocí funkce
count()z balíčkudplyrvytvoř tabulku proměnnýchsexapromote. - Proveď seskupení dat pomocí
group_by()na proměnnésex. - Vypočítej podíl povýšených osob a ulož ho do proměnné
promoted_prop. U binárních proměnných lze podíl libovolné hodnoty zjistit pomocí funkcemean()(např.mean(variable == "value")).
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Create a contingency table summarizing the data
disc %>%
# Count the rows by sex, promote
___
# Find proportion of each sex who were promoted
disc %>%
# Group by sex
___
# Calculate proportion promoted summary stat
___