CommencezCommencez gratuitement

Validation croisée basée sur le temps

Pour terminer, visualisons le comportement de l'itérateur de validation croisée pour séries temporelles dans scikit-learn. Utilisez cet objet pour parcourir vos données une dernière fois et visualiser, à chaque itération, les données d'entraînement utilisées pour ajuster le modèle.

Une instance de l'objet model de régression linéaire est disponible dans votre espace de travail. Les tableaux X et y (données d'entraînement) sont aussi fournis.

Cette activité fait partie du cours

Machine Learning pour les données chronologiques en Python

Voir le cours

Instructions de l’exercice

  • Importez TimeSeriesSplit depuis sklearn.model_selection.
  • Instanciez un itérateur de validation croisée pour séries temporelles avec 10 divisions.
  • Parcourez les divisions de la validation croisée. À chaque itération, visualisez les valeurs des données en entrée qui serviraient à entraîner le modèle pour cette itération.

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Import TimeSeriesSplit
____

# Create time-series cross-validation object
cv = ____

# Iterate through CV splits
fig, ax = plt.subplots()
for ii, (tr, tt) in enumerate(cv.split(X, y)):
    # Plot the training data on each iteration, to see the behavior of the CV
    ax.plot(tr, ii + y[tr])

ax.set(title='Training data on each CV iteration', ylabel='CV iteration')
plt.show()
Modifier et exécuter le code