Bắt đầu ngayBắt đầu miễn phí

Tạo Pipelines

Giờ bạn sẽ dùng một trong những tính năng hay nhất của scikit-learn: Pipelines. Pipelines cho phép bạn xâu chuỗi nhiều thao tác, như biến đổi dữ liệu và ước lượng, được áp dụng tuần tự lên dữ liệu mới.

Bạn sẽ tạo một pipeline gồm cả StandardScaler và bộ ước lượng LogisticRegression.

Cách này cho phép bạn đưa dữ liệu chưa được scale vào pipeline; Scaler sẽ scale dữ liệu, và LogisticRegression sẽ dự đoán cột mục tiêu.

Dữ liệu chưa scale có trong X_train, còn nhãn đã được nạp vào y_train. Một phần dữ liệu, X_test, cũng có sẵn để đánh giá mô hình.

StandardScalerLogisticRegression đã được nhập sẵn cho bạn.

Bài tập này là một phần của khóa học

Phân tích dữ liệu IoT bằng Python

Xem khóa học

Bài tập tương tác thực hành trực tiếp

Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.

# Import pipeline
from ____ import ____

# Create Scaler and Regression objects
sc = ____()
logreg = ____
Chỉnh sửa và Chạy Mã