Curățarea setului de date
Seturile de date din lumea reală, precum cel despre bolile de inimă, sunt adesea dezordonate – conțin valori duplicate sau lipsă. În acest exercițiu, vei aplica abilitățile dobândite în acest capitol pentru a curăța setul de date despre boli de inimă. Setul de date a fost deja încărcat pentru tine. Sarcina ta este să identifici și să realizezi operațiuni generale de curățare pe baza rezultatelor EDA: elimină coloanele goale, șterge rândurile duplicate și efectuează imputarea pe coloana restecg, care corespunde unei măsuri electrocardiografice. Pandas a fost importat pentru tine ca pd, iar setul de date despre boli de inimă este stocat ca un DataFrame pandas numit heart_disease_df.
Acest exercițiu face parte din cursul
Machine Learning End-to-End
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Drop empty columns
heart_disease_column_dropped = heart_disease_df.____(____, ____)