CommencezCommencez gratuitement

Deux échantillons

Après avoir construit plusieurs modèles de classification à partir du jeu de données tic_tac_toe, vous constatez que certains modèles se généralisent moins bien que d'autres. Vous avez créé des ensembles d'entraînement et de test comme on vous l'a appris, alors vous vous demandez pourquoi votre processus de validation ne fonctionne pas.

Après avoir essayé une autre répartition entraînement/test, vous avez remarqué des exactitudes différentes pour votre modèle de machine learning. Avant de vous frustrer devant ces résultats variables, vous avez décidé d'examiner ce qui pourrait se passer d'autre.

Cette activité fait partie du cours

Validation de modèles en Python

Voir le cours

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Create two different samples of 200 observations 
sample1 = tic_tac_toe.____(____, random_state=1111)
sample2 = tic_tac_toe.____(____, random_state=1171)
Modifier et exécuter le code