Bắt đầu ngayBắt đầu miễn phí

Xóa danh xưng và tách tên

Khi thu thập metadata người trả lời khảo sát trong DataFrame airlines, họ tên đầy đủ của người trả lời được lưu trong cột full_name. Tuy nhiên, khi kiểm tra kỹ hơn, bạn thấy nhiều tên được thêm tiền tố là danh xưng như "Dr.", "Mr.", "Ms.""Miss".

Mục tiêu cuối cùng của bạn là tạo hai cột mới tên là first_namelast_name, lần lượt chứa tên và họ của người trả lời. Tuy nhiên, trước khi làm điều đó, bạn cần xóa các danh xưng.

DataFrame airlines đã có sẵn trong môi trường của bạn, cùng với pandas được nhập là pd.

Bài tập này là một phần của khóa học

Làm sạch dữ liệu với Python

Xem khóa học

Hướng dẫn bài tập

  • Xóa "Dr.", "Mr.", "Miss""Ms." khỏi full_name bằng cách thay thế chúng bằng chuỗi rỗng "" theo đúng thứ tự đó.
  • Chạy câu lệnh assert sử dụng .str.contains() để kiểm tra xem full_name còn chứa bất kỳ danh xưng nào không.

Bài tập tương tác thực hành trực tiếp

Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.

# Replace "Dr." with empty string ""
airlines['full_name'] = airlines['full_name'].____.____("____","")

# Replace "Mr." with empty string ""
airlines['full_name'] = ____

# Replace "Miss" with empty string ""
____

# Replace "Ms." with empty string ""
____

# Assert that full_name has no honorifics
assert airlines['full_name'].str.contains('Ms.|Mr.|Miss|Dr.').any() == False
Chỉnh sửa và Chạy Mã