Ваш перший TfIdf
У цій вправі ви застосуєте метод TfIdf до невеликого набору даних annak, що містить перше речення з роману «Анна Кареніна» Льва Толстого.
Ваше завдання — попрацювати з цим набором даних і застосувати функцію TfidfVectorizer(). Згадайте, що числове перетворення тексту — це перший крок до розуміння його тональності. Векторизатор Tfidf — це ще один спосіб побудувати словник з нашого стовпця з тональністю.
Ця вправа є частиною курсу
Аналіз тональності в Python
Інструкції до вправи
- Імпортуйте функцію для побудови векторизатора TfIdf із
sklearn.feature_extraction.text. - Викличте функцію
TfidfVectorizer()і навчіть її на наборі данихannak. - Виконайте перетворення за допомогою векторизатора.
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Import the required function
____
annak = ['Happy families are all alike;', 'every unhappy family is unhappy in its own way']
# Call the vectorizer and fit it
anna_vect = ____.___(annak)
# Create the tfidf representation
anna_tfidf = anna_vect.____(annak)
# Print the result
print(anna_tfidf.toarray())