CommencezCommencez gratuitement

Retirer la ponctuation

Maintenant que vous avez retiré les mots vides du texte d'évaluation, il est temps de traiter la ponctuation. Les jetons obtenus à l'exercice précédent contiennent encore des signes de ponctuation, qui sont souvent inutiles pour classer les commentaires.

Votre tâche consiste à enlever la ponctuation de la liste de jetons fournie afin de nettoyer encore davantage les données.

Cette activité fait partie du cours

Natural Language Processing (NLP) en Python

Voir le cours

Instructions de l’exercice

  • Nettoyez la liste filtered_tokens en retirant toute la ponctuation.

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

import string

filtered_tokens = ['reached', 'support', 'got', 'helpful', 'response', 'within', 'minutes', '!', '!', '!', '#', 'impressed']

# Remove punctuation
clean_tokens = [____ for word in filtered_tokens if ____ not in ____.____]

print(clean_tokens)
Modifier et exécuter le code