Xóa danh xưng và tách tên
Khi thu thập metadata người trả lời khảo sát trong DataFrame airlines, họ tên đầy đủ của người trả lời được lưu trong cột full_name. Tuy nhiên, khi kiểm tra kỹ hơn, bạn thấy nhiều tên được thêm tiền tố là danh xưng như "Dr.", "Mr.", "Ms." và "Miss".
Mục tiêu cuối cùng của bạn là tạo hai cột mới tên là first_name và last_name, lần lượt chứa tên và họ của người trả lời. Tuy nhiên, trước khi làm điều đó, bạn cần xóa các danh xưng.
DataFrame airlines đã có sẵn trong môi trường của bạn, cùng với pandas được nhập là pd.
Bài tập này là một phần của khóa học
Làm sạch dữ liệu với Python
Hướng dẫn bài tập
- Xóa
"Dr.","Mr.","Miss"và"Ms."khỏifull_namebằng cách thay thế chúng bằng chuỗi rỗng""theo đúng thứ tự đó. - Chạy câu lệnh
assertsử dụng.str.contains()để kiểm tra xemfull_namecòn chứa bất kỳ danh xưng nào không.
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
# Replace "Dr." with empty string ""
airlines['full_name'] = airlines['full_name'].____.____("____","")
# Replace "Mr." with empty string ""
airlines['full_name'] = ____
# Replace "Miss" with empty string ""
____
# Replace "Ms." with empty string ""
____
# Assert that full_name has no honorifics
assert airlines['full_name'].str.contains('Ms.|Mr.|Miss|Dr.').any() == False