शुरू करेंमुफ़्त में शुरू करें

अपने डेटासेट की सफाई

वास्तविक दुनिया के डेटासेट, जैसे heart disease डेटासेट, अक्सर बिखरे होते हैं और उनमें डुप्लिकेट या मिसिंग वैल्यूज़ होती हैं। इस अभ्यास में, आप इस अध्याय में सीखे गए स्किल्स का उपयोग करके heart disease डेटासेट पर डेटा क्लीनिंग करेंगे। डेटासेट पहले से आपके लिए लोड किया गया है। आपका काम EDA के नतीजों के आधार पर सामान्य क्लीनिंग ऑपरेशंस पहचानना और करना है: खाली कॉलम हटाना, डुप्लिकेट रोज़ ड्रॉप करना, और restecg कॉलम पर इम्प्यूटेशन करना, जो एक इलेक्ट्रोकार्डियोग्राम माप से संबंधित है। Pandas आपके लिए pd नाम से आयात किया गया है, और heart disease डेटासेट heart_disease_df नाम के pandas DataFrame में स्टोर है।

यह अभ्यास पाठ्यक्रम का हिस्सा है

एंड-टू-एंड मशीन लर्निंग

पाठ्यक्रम देखें

इंटरैक्टिव व्यावहारिक अभ्यास

इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।

# Drop empty columns
heart_disease_column_dropped = heart_disease_df.____(____, ____)
कोड संपादित करें और चलाएँ