Začněte nyníZačněte zdarma

Kmeny z tweetů

V tomto cvičení budeš pracovat s polem tweets, které obsahuje texty z dat o náladě cestujících aerolinek sebraných z Twitteru.

Tvým úkolem je toto pole transformovat do seznamu tokenů pomocí list comprehension. Poté iteruj přes seznam tokenů a z každého tokenu vytvoř kmen. Nezapomeň, že list comprehension je jednořádková alternativa k for cyklům.

Toto cvičení je součástí kurzu

Sentiment Analysis v Pythonu

Zobrazit kurz

Pokyny k cvičení

  • Importuj funkci, kterou používáme k převodu řetězců na kmeny.
  • Zavolej funkci Porter stemmer, kterou jsi právě importoval/a.
  • Pomocí list comprehension vytvoř seznam tokens. Měl by obsahovat všechny slovní tokeny z pole tweets.
  • Iteruj přes seznam tokens a na každý jeho prvek aplikuj stemmovací funkci.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Import the function to perform stemming
____
from nltk import word_tokenize

# Call the stemmer
porter = ____()

# Transform the array of tweets to tokens
tokens = [____]
# Stem the list of tokens
stemmed_tokens = [[____.____(word) for word in tweet] for tweet in tokens] 
# Print the first element of the list
print(stemmed_tokens[0])
Upravit a spustit kód