Вилучення пропущених даних
Упродовж наступних трьох вправ ви впорядкуєте набір даних music_df. Ви створите конвеєр (pipeline) для імпутації пропущених значень і побудуєте модель класифікатора KNN, а потім використаєте її, щоб передбачити, чи належить пісня до жанру "Rock".
У цій вправі зокрема ви вилучите пропущені значення, яких менше ніж 5% від усього набору даних, і перетворите стовпець "genre" на бінарну ознаку.
Ця вправа є частиною курсу
Кероване навчання зі scikit-learn
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Print missing values for each column
____