Retirer la ponctuation
Maintenant que vous avez retiré les mots vides du texte d'évaluation, il est temps de traiter la ponctuation. Les jetons obtenus à l'exercice précédent contiennent encore des signes de ponctuation, qui sont souvent inutiles pour classer les commentaires.
Votre tâche consiste à enlever la ponctuation de la liste de jetons fournie afin de nettoyer encore davantage les données.
Cette activité fait partie du cours
Natural Language Processing (NLP) en Python
Instructions de l’exercice
- Nettoyez la liste
filtered_tokensen retirant toute la ponctuation.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
import string
filtered_tokens = ['reached', 'support', 'got', 'helpful', 'response', 'within', 'minutes', '!', '!', '!', '#', 'impressed']
# Remove punctuation
clean_tokens = [____ for word in filtered_tokens if ____ not in ____.____]
print(clean_tokens)