Préparation des données
Vous créez un modèle de Machine Learning qui utilise le TALN pour un projet d'analyse des sentiments classant les avis de restaurants comme positifs, négatifs ou neutres. Pour préparer les données à l'entraînement, vous devez prétraiter le texte et le représenter numériquement.
Votre jeu de données contient des milliers d'avis, dont un qui dit :
"The food was delicious, but the service was extremely slow."
Quelles étapes de prétraitement du texte sont les plus susceptibles de retirer les mots « but » et « was » de cet avis ?
Cette activité fait partie du cours
Concepts sur les grands modèles de langage (LLM)
Exercice interactif pratique
Passez de la théorie à l’action grâce à l’un de nos exercices interactifs
Commencer l’exercice