Kmeny z tweetů
V tomto cvičení budeš pracovat s polem tweets, které obsahuje texty z dat o náladě cestujících aerolinek sebraných z Twitteru.
Tvým úkolem je toto pole transformovat do seznamu tokenů pomocí list comprehension. Poté iteruj přes seznam tokenů a z každého tokenu vytvoř kmen. Nezapomeň, že list comprehension je jednořádková alternativa k for cyklům.
Toto cvičení je součástí kurzu
Sentiment Analysis v Pythonu
Pokyny k cvičení
- Importuj funkci, kterou používáme k převodu řetězců na kmeny.
- Zavolej funkci Porter stemmer, kterou jsi právě importoval/a.
- Pomocí list comprehension vytvoř seznam
tokens. Měl by obsahovat všechny slovní tokeny z poletweets. - Iteruj přes seznam
tokensa na každý jeho prvek aplikuj stemmovací funkci.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Import the function to perform stemming
____
from nltk import word_tokenize
# Call the stemmer
porter = ____()
# Transform the array of tweets to tokens
tokens = [____]
# Stem the list of tokens
stemmed_tokens = [[____.____(word) for word in tweet] for tweet in tokens]
# Print the first element of the list
print(stemmed_tokens[0])