CommencezCommencez gratuitement

Créer des pipelines

Vous allez maintenant utiliser l'une des meilleures fonctionnalités offertes par scikit-learn : les Pipelines. Les Pipelines permettent d'enchaîner plusieurs actions, comme des transformations et des estimations, qui sont appliquées séquentiellement à de nouvelles données.

Vous allez créer un pipeline contenant à la fois un StandardScaler et un estimateur LogisticRegression.

Cela vous permet de transmettre des données non normalisées au pipeline : le Scaler mettra les données à l'échelle et LogisticRegression prédira la colonne cible.

Les données non normalisées sont disponibles sous X_train, tandis que les étiquettes ont été chargées sous y_train. Un sous-ensemble des données, X_test, est aussi disponible pour évaluer le modèle.

StandardScaler et LogisticRegression ont été importés pour vous.

Cette activité fait partie du cours

Analyse de données IoT avec Python

Voir le cours

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Import pipeline
from ____ import ____

# Create Scaler and Regression objects
sc = ____()
logreg = ____
Modifier et exécuter le code