Kom igångKom igång gratis

Stammar från tweets

I den här övningen arbetar du med en array som heter tweets. Den innehåller texten från flygbolagens sentimentdata som samlats in från Twitter.

Din uppgift är att arbeta med den här arrayen och omvandla den till en lista med tokens via listomfattning. Iterera sedan över tokenlistan och skapa en stam av varje token. Kom ihåg att listomfattningar är ett kompakt alternativ till for-loopar på en enda rad.

Den här övningen är en del av kursen

Sentimentanalys i Python

Visa kurs

Övningsinstruktioner

  • Importera funktionen som används för att omvandla strängar till stammar.
  • Anropa Porter-stemmerfunktionen du just importerade.
  • Skapa listan tokens med hjälp av listomfattning. Den ska innehålla alla ordtokens från arrayen tweets.
  • Iterera över listan tokens och tillämpa stemningsfunktionen på varje element i listan.

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Import the function to perform stemming
____
from nltk import word_tokenize

# Call the stemmer
porter = ____()

# Transform the array of tweets to tokens
tokens = [____]
# Stem the list of tokens
stemmed_tokens = [[____.____(word) for word in tweet] for tweet in tokens] 
# Print the first element of the list
print(stemmed_tokens[0])
Redigera och kör kod