Matrices de confusion
Vous venez de terminer la création d'un modèle de classification. Ce modèle prédit si des tweets ont été créés par un robot de clavardage à tendance gauche (démocrate) ou à tendance droite (républicain). Vous avez fait des prédictions sur les données de test et obtenu le résultat suivant :
| Prédictions | Gauche | Droite |
|---|---|---|
| Gauche | 350 | 157 |
| Droite | 57 | 436 |
Servez-vous de la matrice de confusion ci-dessus pour répondre aux questions sur la justesse du modèle.
Cette activité fait partie du cours
Introduction au traitement automatique des langues en R
Instructions de l’exercice
- Quel pourcentage de tweets avez-vous correctement étiquetés comme
Left? - Quel pourcentage de tweets avez-vous correctement étiquetés comme
Right? - Quel pourcentage de tweets avez-vous correctement étiquetés?
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Percentage correctly labeled "Left"
left <- (___) / (350 + 157)
left
# Percentage correctly labeled "Right"
right <- (___) / (___ + ___)
right
# Overall Accuracy:
accuracy <- (___ + ___) / (___ + ___ + ___ + ___)
accuracy