CommencezCommencez gratuitement

Préparation des données

Vous créez un modèle de Machine Learning qui utilise le TALN pour un projet d'analyse des sentiments classant les avis de restaurants comme positifs, négatifs ou neutres. Pour préparer les données à l'entraînement, vous devez prétraiter le texte et le représenter numériquement.

Votre jeu de données contient des milliers d'avis, dont un qui dit :

"The food was delicious, but the service was extremely slow."

Quelles étapes de prétraitement du texte sont les plus susceptibles de retirer les mots « but » et « was » de cet avis ?

Cette activité fait partie du cours

Concepts sur les grands modèles de langage (LLM)

Voir le cours

Exercice interactif pratique

Passez de la théorie à l’action grâce à l’un de nos exercices interactifs

Commencer l’exercice