Пошук узгодженості
У цій вправі та протягом усього розділу ви працюватимете з датафреймом airlines, який містить відповіді на опитування клієнтів авіакомпаній про аеропорт Сан-Франциско.
Дані включають метадані рейсів, зокрема авіакомпанію, пункт призначення, час очікування, а також відповіді на ключові питання щодо чистоти, безпеки та задоволеності. Також створено датафрейм categories, що містить усі коректні можливі значення для стовпців опитування.
У цій вправі ви використаєте обидва датафрейми, щоб знайти відповіді з неузгодженими значеннями та видалити їх, фактично виконавши зовнішнє та внутрішнє об’єднання для цих датафреймів, як показано у відео. Пакет pandas імпортовано як pd, а датафрейми airlines і categories доступні у вашому середовищі.
Ця вправа є частиною курсу
Очищення даних у Python
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Print categories DataFrame
print(____)
# Print unique values of survey columns in airlines
print('Cleanliness: ', airlines['cleanliness'].____, "\n")
print('Safety: ', ____, "\n")
print('Satisfaction: ', ____, "\n")