Kom igångKom igång gratis

Rensa din datamängd

Verkliga datamängder som hjärtsjukdomsdatasetet är ofta röriga och kan innehålla dubbletter eller saknade värden. I den här övningen tillämpar du de färdigheter du lärt dig i det här kapitlet för att rensa hjärtsjukdomsdatasetet. Datamängden har redan laddats in åt dig. Din uppgift är att identifiera och genomföra grundläggande rensningsåtgärder baserade på resultaten från den explorativa dataanalysen: ta bort tomma kolumner, radera dubbletter och utför imputering på kolumnen restecg, som avser ett elektrokardiogrammått. Pandas har importerats åt dig som pd, och hjärtsjukdomsdatasetet är lagrat som en pandas DataFrame kallad heart_disease_df.

Den här övningen är en del av kursen

End-to-End Machine Learning

Visa kurs

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Drop empty columns
heart_disease_column_dropped = heart_disease_df.____(____, ____)
Redigera och kör kod