Tải tập dữ liệu
NannyML đi kèm một số tập dữ liệu nội bộ để giúp bạn dễ dàng demo các trường hợp sử dụng và thử nghiệm các thuật toán khác nhau. Để tải tập dữ liệu, bạn chỉ cần dùng hàm nannyml.load_us_census_ma_employment_data().
Hàm này trả về ba đối tượng DataFrame của Pandas: bộ tham chiếu (tập kiểm thử), bộ phân tích (dữ liệu sản xuất chưa thấy trước), và ground truth cho bộ phân tích. Hãy đặt tên các data frame này theo quy ước là reference, analysis, và analysis_gt.
Trong bài tập này, bạn sẽ tải tập dữ liệu US Census Employment và in các data frame để hình dung cấu trúc của chúng.
Bài tập này là một phần của khóa học
Giám sát Machine Learning bằng Python
Hướng dẫn bài tập
- Import thư viện
nannyml. - Tải tập dữ liệu US Census Employment từ thư viện
nannyml. - In phần đầu của dữ liệu tham chiếu bằng
.head(). - In phần đầu của dữ liệu phân tích bằng
.head().
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
# Import nannyml
import ____
# Load US Census Employment dataset
____, ____, ____ = ____.____()
# Print head of the reference data
____
# Print head of the analysis data
____