ПочатиПочніть безкоштовно

Очищення вашого набору даних

Реальні набори даних, як-от набір про серцеві захворювання, часто неохайні: містять дублікати або пропущені значення. У цій вправі ви застосуєте навички з цього розділу, щоб виконати очищення даних у наборі про серцеві захворювання. Набір даних уже завантажено. Ваше завдання — визначити й виконати загальні операції очищення на основі результатів EDA: вилучити порожні стовпці, видалити дублікати рядків і виконати імпутацію у стовпці restecg, який відповідає показнику електрокардіограми. Pandas уже імпортовано як pd, а набір про серцеві захворювання збережено як датафрейм pandas під назвою heart_disease_df.

Ця вправа є частиною курсу

End-to-End Machine Learning

Переглянути курс

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# Drop empty columns
heart_disease_column_dropped = heart_disease_df.____(____, ____)
Редагувати та запускати код