Deux échantillons
Après avoir construit plusieurs modèles de classification à partir du jeu de données tic_tac_toe, vous constatez que certains modèles se généralisent moins bien que d'autres. Vous avez créé des ensembles d'entraînement et de test comme on vous l'a appris, alors vous vous demandez pourquoi votre processus de validation ne fonctionne pas.
Après avoir essayé une autre répartition entraînement/test, vous avez remarqué des exactitudes différentes pour votre modèle de machine learning. Avant de vous frustrer devant ces résultats variables, vous avez décidé d'examiner ce qui pourrait se passer d'autre.
Cette activité fait partie du cours
Validation de modèles en Python
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Create two different samples of 200 observations
sample1 = tic_tac_toe.____(____, random_state=1111)
sample2 = tic_tac_toe.____(____, random_state=1171)