НачатьНачать бесплатно

Удаление обращений и работа с именами

При сборе метаданных респондентов опроса в DataFrame airlines полные имена участников сохранялись в столбце full_name. Однако при более внимательном изучении выяснилось, что многие имена содержат обращения: "Dr.", "Mr.", "Ms." и "Miss".

Ваша конечная цель — создать два новых столбца, first_name и last_name, содержащих имя и фамилию респондентов соответственно. Но сначала необходимо удалить обращения.

DataFrame airlines доступен в вашей среде, а также библиотека pandas под псевдонимом pd.

Это упражнение является частью курса

Очистка данных в Python

Посмотреть курс

Инструкции к упражнению

  • Удалите "Dr.", "Mr.", "Miss" и "Ms." из столбца full_name, заменив их пустой строкой "" в указанном порядке.
  • Запустите оператор assert с использованием .str.contains(), чтобы проверить, остались ли в full_name какие-либо из перечисленных обращений.

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Replace "Dr." with empty string ""
airlines['full_name'] = airlines['full_name'].____.____("____","")

# Replace "Mr." with empty string ""
airlines['full_name'] = ____

# Replace "Miss" with empty string ""
____

# Replace "Ms." with empty string ""
____

# Assert that full_name has no honorifics
assert airlines['full_name'].str.contains('Ms.|Mr.|Miss|Dr.').any() == False
Редактировать и запускать код