Удаление обращений и работа с именами
При сборе метаданных респондентов опроса в DataFrame airlines полные имена участников сохранялись в столбце full_name. Однако при более внимательном изучении выяснилось, что многие имена содержат обращения: "Dr.", "Mr.", "Ms." и "Miss".
Ваша конечная цель — создать два новых столбца, first_name и last_name, содержащих имя и фамилию респондентов соответственно. Но сначала необходимо удалить обращения.
DataFrame airlines доступен в вашей среде, а также библиотека pandas под псевдонимом pd.
Это упражнение является частью курса
Очистка данных в Python
Инструкции к упражнению
- Удалите
"Dr.","Mr.","Miss"и"Ms."из столбцаfull_name, заменив их пустой строкой""в указанном порядке. - Запустите оператор
assertс использованием.str.contains(), чтобы проверить, остались ли вfull_nameкакие-либо из перечисленных обращений.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Replace "Dr." with empty string ""
airlines['full_name'] = airlines['full_name'].____.____("____","")
# Replace "Mr." with empty string ""
airlines['full_name'] = ____
# Replace "Miss" with empty string ""
____
# Replace "Ms." with empty string ""
____
# Assert that full_name has no honorifics
assert airlines['full_name'].str.contains('Ms.|Mr.|Miss|Dr.').any() == False