Racines à partir de tweets
Dans cet exercice, vous travaillerez avec un tableau nommé tweets. Il contient le texte des données de sentiment sur les compagnies aériennes recueillies sur Twitter.
Votre tâche consiste à transformer ce tableau en une liste de jetons (tokens) au moyen d'une compréhension de liste. Ensuite, parcourez la liste de jetons et obtenez la racine de chaque jeton. Rappelez-vous que les compréhensions de liste sont une solution en une seule ligne qui remplace les boucles for.
Cette activité fait partie du cours
Analyse de sentiment en Python
Instructions de l’exercice
- Importez la fonction que nous avons utilisée pour transformer des chaînes en racines (stems).
- Appelez la fonction de racinisation Porter que vous venez d'importer.
- À l'aide d'une compréhension de liste, créez la liste
tokens. Elle doit contenir tous les jetons de mots provenant du tableautweets. - Parcourez la liste
tokenset appliquez la fonction de racinisation à chaque élément de la liste.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Import the function to perform stemming
____
from nltk import word_tokenize
# Call the stemmer
porter = ____()
# Transform the array of tweets to tokens
tokens = [____]
# Stem the list of tokens
stemmed_tokens = [[____.____(word) for word in tweet] for tweet in tokens]
# Print the first element of the list
print(stemmed_tokens[0])