ÎncepețiÎncepe gratuit

Curățarea setului de date

Seturile de date din lumea reală, precum cel despre bolile de inimă, sunt adesea dezordonate – conțin valori duplicate sau lipsă. În acest exercițiu, vei aplica abilitățile dobândite în acest capitol pentru a curăța setul de date despre boli de inimă. Setul de date a fost deja încărcat pentru tine. Sarcina ta este să identifici și să realizezi operațiuni generale de curățare pe baza rezultatelor EDA: elimină coloanele goale, șterge rândurile duplicate și efectuează imputarea pe coloana restecg, care corespunde unei măsuri electrocardiografice. Pandas a fost importat pentru tine ca pd, iar setul de date despre boli de inimă este stocat ca un DataFrame pandas numit heart_disease_df.

Acest exercițiu face parte din cursul

Machine Learning End-to-End

Vezi cursul

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

# Drop empty columns
heart_disease_column_dropped = heart_disease_df.____(____, ____)
Editează și rulează codul