मिसिंग वैल्यूज़ का पता लगाना
अधिकतर डेटासेट्स में मिसिंग वैल्यूज़ छिपी होती हैं, जिन्हें 'NA', '.' या अन्य placeholders से भरा जाता है। इस अभ्यास में आप college डेटासेट पर काम करेंगे, जिसमें कॉलेज छात्रों के विभिन्न विवरण हैं। आपका काम डेटासेट का विश्लेषण करके मिसिंग वैल्यूज़ की पहचान करना है.
इसके लिए आप pandas की .info() मेथड और numpy के sort() फंक्शन को .unique() मेथड के साथ उपयोग कर सकते हैं, ताकि मिसिंग डेटा का प्रतिनिधित्व करने वाले डमी वैल्यू को साफ़-साफ़ अलग किया जा सके.
college.csv फ़ाइल आपके लिए लोड कर दी गई है। numpy और pandas पैकेज क्रमशः np और pd के रूप में पहले से इम्पोर्ट हैं.
यह अभ्यास पाठ्यक्रम का हिस्सा है
Python में Missing Data से निपटना
इंटरैक्टिव व्यावहारिक अभ्यास
इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।
# Read the dataset 'college.csv'
college = ___
print(college.head())