Bắt đầu ngayBắt đầu miễn phí

Tải tập dữ liệu

NannyML đi kèm một số tập dữ liệu nội bộ để giúp bạn dễ dàng demo các trường hợp sử dụng và thử nghiệm các thuật toán khác nhau. Để tải tập dữ liệu, bạn chỉ cần dùng hàm nannyml.load_us_census_ma_employment_data().

Hàm này trả về ba đối tượng DataFrame của Pandas: bộ tham chiếu (tập kiểm thử), bộ phân tích (dữ liệu sản xuất chưa thấy trước), và ground truth cho bộ phân tích. Hãy đặt tên các data frame này theo quy ước là reference, analysis, và analysis_gt.

Trong bài tập này, bạn sẽ tải tập dữ liệu US Census Employment và in các data frame để hình dung cấu trúc của chúng.

Bài tập này là một phần của khóa học

Giám sát Machine Learning bằng Python

Xem khóa học

Hướng dẫn bài tập

  • Import thư viện nannyml.
  • Tải tập dữ liệu US Census Employment từ thư viện nannyml.
  • In phần đầu của dữ liệu tham chiếu bằng .head().
  • In phần đầu của dữ liệu phân tích bằng .head().

Bài tập tương tác thực hành trực tiếp

Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.

# Import nannyml
import ____

# Load US Census Employment dataset
____, ____, ____ = ____.____()

# Print head of the reference data
____

# Print head of the analysis data
____
Chỉnh sửa và Chạy Mã