लिंग-आधारित भेदभाव का सारांश
किसी भी विश्लेषण के पहले चरण के रूप में, आपको डेटा को देखना और उसका सारांश बनाना चाहिए। श्रेणीबद्ध वैरिएबल्स का सारांश अक्सर अनुपात से किया जाता है, और अनुपात के हर (denominator) को समझना हमेशा ज़रूरी होता है।
क्या आप उन महिलाओं का अनुपात चाहते हैं जिन्हें प्रमोट किया गया, या उन प्रमोटेड व्यक्तियों में महिलाओं का अनुपात? यहाँ आपको पहला अनुपात चाहिए, इसलिए अपने R कोड में sex वैरिएबल पर group_by() करना आवश्यक है।
डिस्क्रिमिनेशन स्टडी का डेटा आपके वर्कस्पेस में disc नाम से उपलब्ध है।
यह अभ्यास पाठ्यक्रम का हिस्सा है
R में Inference की बुनियाद
अभ्यास निर्देश
dplyrकेcount()फंक्शन का उपयोग करकेsexऔरpromoteवैरिएबल्स की तालिका बनाएँ.sexवैरिएबल परgroup_by()का उपयोग करके डेटा का सारांश बनाएँ.- जिन लोगों को प्रमोट किया गया, उनका अनुपात निकालें। इस वैरिएबल का नाम
promoted_propरखें। ध्यान दें कि बाइनरी वैरिएबल्स के लिए, किसी भी वैल्यू का अनुपातmean()फंक्शन से निकाला जा सकता है (जैसेmean(variable == "value")).
इंटरैक्टिव व्यावहारिक अभ्यास
इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।
# Create a contingency table summarizing the data
disc %>%
# Count the rows by sex, promote
___
# Find proportion of each sex who were promoted
disc %>%
# Group by sex
___
# Calculate proportion promoted summary stat
___