Začněte nyníZačněte zdarma

Tvůj první TfIdf

V tomto cvičení použiješ metodu TfIdf na malý dataset annak, který obsahuje první větu románu Anna Karenina od Lva Tolstého.

Tvým úkolem bude pracovat s tímto datasetem a použít funkci TfidfVectorizer(). Připomeň si, že numerická transformace textu je prvním krokem k pochopení sentimentu. TfIdf vektorizér je další způsob, jak sestavit slovník ze sloupce se sentimentem.

Toto cvičení je součástí kurzu

Sentiment Analysis v Pythonu

Zobrazit kurz

Pokyny k cvičení

  • Importuj funkci pro vytvoření TfIdf vektorizéru z sklearn.feature_extraction.text.
  • Zavolej funkci TfidfVectorizer() a natrénuj ji na datasetu annak.
  • Transformuj vektorizér.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Import the required function
____

annak = ['Happy families are all alike;', 'every unhappy family is unhappy in its own way']

# Call the vectorizer and fit it
anna_vect = ____.___(annak)

# Create the tfidf representation
anna_tfidf = anna_vect.____(annak)

# Print the result 
print(anna_tfidf.toarray())
Upravit a spustit kód