ПочатиПочніть безкоштовно

Ваш перший TfIdf

У цій вправі ви застосуєте метод TfIdf до невеликого набору даних annak, що містить перше речення з роману «Анна Кареніна» Льва Толстого.

Ваше завдання — попрацювати з цим набором даних і застосувати функцію TfidfVectorizer(). Згадайте, що числове перетворення тексту — це перший крок до розуміння його тональності. Векторизатор Tfidf — це ще один спосіб побудувати словник з нашого стовпця з тональністю.

Ця вправа є частиною курсу

Аналіз тональності в Python

Переглянути курс

Інструкції до вправи

  • Імпортуйте функцію для побудови векторизатора TfIdf із sklearn.feature_extraction.text.
  • Викличте функцію TfidfVectorizer() і навчіть її на наборі даних annak.
  • Виконайте перетворення за допомогою векторизатора.

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# Import the required function
____

annak = ['Happy families are all alike;', 'every unhappy family is unhappy in its own way']

# Call the vectorizer and fit it
anna_vect = ____.___(annak)

# Create the tfidf representation
anna_tfidf = anna_vect.____(annak)

# Print the result 
print(anna_tfidf.toarray())
Редагувати та запускати код