Вилучення звертань і виокремлення імен
Під час збирання метаданих респондентів опитування у датафреймі airlines повне ім’я респондентів було збережено в стовпці full_name. Однак, після детальнішої перевірки ви виявили, що багато різних імен мають префікси-звертання, такі як "Dr.", "Mr.", "Ms." та "Miss".
Ваша кінцева мета — створити два нові стовпці під назвою first_name і last_name, які відповідно міститимуть ім’я та прізвище респондентів. Проте перед цим потрібно вилучити звертання.
Датасет airlines доступний у вашому середовищі, так само як і pandas під псевдонімом pd.
Ця вправа є частиною курсу
Очищення даних у Python
Інструкції до вправи
- Видаліть
"Dr.","Mr.","Miss"і"Ms."зі стовпцяfull_name, замінивши їх на порожній рядок""саме в такому порядку. - Запустіть оператор
assert, використовуючи.str.contains(), щоб перевірити, чи міститьfull_nameще якісь із цих звертань.
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Replace "Dr." with empty string ""
airlines['full_name'] = airlines['full_name'].____.____("____","")
# Replace "Mr." with empty string ""
airlines['full_name'] = ____
# Replace "Miss" with empty string ""
____
# Replace "Ms." with empty string ""
____
# Assert that full_name has no honorifics
assert airlines['full_name'].str.contains('Ms.|Mr.|Miss|Dr.').any() == False