ПочатиПочніть безкоштовно

Вилучення звертань і виокремлення імен

Під час збирання метаданих респондентів опитування у датафреймі airlines повне ім’я респондентів було збережено в стовпці full_name. Однак, після детальнішої перевірки ви виявили, що багато різних імен мають префікси-звертання, такі як "Dr.", "Mr.", "Ms." та "Miss".

Ваша кінцева мета — створити два нові стовпці під назвою first_name і last_name, які відповідно міститимуть ім’я та прізвище респондентів. Проте перед цим потрібно вилучити звертання.

Датасет airlines доступний у вашому середовищі, так само як і pandas під псевдонімом pd.

Ця вправа є частиною курсу

Очищення даних у Python

Переглянути курс

Інструкції до вправи

  • Видаліть "Dr.", "Mr.", "Miss" і "Ms." зі стовпця full_name, замінивши їх на порожній рядок "" саме в такому порядку.
  • Запустіть оператор assert, використовуючи .str.contains(), щоб перевірити, чи містить full_name ще якісь із цих звертань.

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# Replace "Dr." with empty string ""
airlines['full_name'] = airlines['full_name'].____.____("____","")

# Replace "Mr." with empty string ""
airlines['full_name'] = ____

# Replace "Miss" with empty string ""
____

# Replace "Ms." with empty string ""
____

# Assert that full_name has no honorifics
assert airlines['full_name'].str.contains('Ms.|Mr.|Miss|Dr.').any() == False
Редагувати та запускати код