शुरू करेंमुफ़्त में शुरू करें

डेटा के वितरण का अन्वेषण करें

जब हम किसी डेटासेट को बहुत यथार्थवादी तरीके से सैंपल करके अनॉनिमाइज़ करना चाहते हैं, तो हमें डेटा का कुछ डोमेन और सांख्यिकीय ज्ञान चाहिए होता है। जैसा कि आपने देखा, रुचि वाले कॉलम का probability distribution ढूँढना मुख्य कदम है।

इस अभ्यास में, आप IBM HR डेटासेट के एक सरलीकृत संस्करण से business_travel कॉलम का अन्वेषण करेंगे।

DataFrame को hr के रूप में और numpy को np के रूप में इम्पोर्ट किया गया है। पिछले अध्याय में बताया गया था कि इस अध्याय और पूरे कोर्स में pandas को pd के रूप में इम्पोर्ट किया गया है।

यह अभ्यास पाठ्यक्रम का हिस्सा है

Python में डेटा प्राइवेसी और अज्ञातिकरण

पाठ्यक्रम देखें

इंटरैक्टिव व्यावहारिक अभ्यास

इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।

# Print the absolute frequencies of each unique value
print(____)
कोड संपादित करें और चलाएँ