CommencezCommencez gratuitement

Racines à partir de tweets

Dans cet exercice, vous travaillerez avec un tableau nommé tweets. Il contient le texte des données de sentiment sur les compagnies aériennes recueillies sur Twitter.

Votre tâche consiste à transformer ce tableau en une liste de jetons (tokens) au moyen d'une compréhension de liste. Ensuite, parcourez la liste de jetons et obtenez la racine de chaque jeton. Rappelez-vous que les compréhensions de liste sont une solution en une seule ligne qui remplace les boucles for.

Cette activité fait partie du cours

Analyse de sentiment en Python

Voir le cours

Instructions de l’exercice

  • Importez la fonction que nous avons utilisée pour transformer des chaînes en racines (stems).
  • Appelez la fonction de racinisation Porter que vous venez d'importer.
  • À l'aide d'une compréhension de liste, créez la liste tokens. Elle doit contenir tous les jetons de mots provenant du tableau tweets.
  • Parcourez la liste tokens et appliquez la fonction de racinisation à chaque élément de la liste.

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Import the function to perform stemming
____
from nltk import word_tokenize

# Call the stemmer
porter = ____()

# Transform the array of tweets to tokens
tokens = [____]
# Stem the list of tokens
stemmed_tokens = [[____.____(word) for word in tweet] for tweet in tokens] 
# Print the first element of the list
print(stemmed_tokens[0])
Modifier et exécuter le code