Bắt đầu ngayBắt đầu miễn phí

Phát hiện giá trị khuyết

Các bộ dữ liệu thường có các giá trị khuyết ẩn được điền bằng những mã như 'NA', '.' hoặc ký hiệu khác. Trong bài tập này, bạn sẽ làm việc với bộ dữ liệu college chứa nhiều thông tin về sinh viên đại học. Nhiệm vụ của bạn là nhận diện các giá trị khuyết bằng cách phân tích bộ dữ liệu.

Để làm điều này, bạn có thể dùng phương thức .info() của pandas và hàm sort() của numpy cùng với phương thức .unique() để phân biệt rõ giá trị giả đại diện cho dữ liệu khuyết.

Tệp college.csv đã được nạp sẵn. Các gói numpypandas cũng đã được import với tên lần lượt là nppd.

Bài tập này là một phần của khóa học

Xử lý Dữ liệu Khuyết trong Python

Xem khóa học

Bài tập tương tác thực hành trực tiếp

Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.

# Read the dataset 'college.csv'
college = ___
print(college.head())
Chỉnh sửa và Chạy Mã