ПочатиПочніть безкоштовно

Вилучення пропущених даних

Упродовж наступних трьох вправ ви впорядкуєте набір даних music_df. Ви створите конвеєр (pipeline) для імпутації пропущених значень і побудуєте модель класифікатора KNN, а потім використаєте її, щоб передбачити, чи належить пісня до жанру "Rock".

У цій вправі зокрема ви вилучите пропущені значення, яких менше ніж 5% від усього набору даних, і перетворите стовпець "genre" на бінарну ознаку.

Ця вправа є частиною курсу

Кероване навчання зі scikit-learn

Переглянути курс

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# Print missing values for each column
____
Редагувати та запускати код