आपका पहला TfIdf
इस अभ्यास में, आप छोटे annak डेटासेट पर TfIdf मेथड लागू करेंगे, जिसमें लियो टॉल्स्टॉय के उपन्यास Anna Karenina का पहला वाक्य है।
आपका कार्य इस डेटासेट के साथ काम करना और TfidfVectorizer() फंक्शन लागू करना है। याद करें, टेक्स्ट का न्यूमेरिक ट्रांसफॉर्मेशन करना, टेक्स्ट के सेंटिमेंट को समझने की दिशा में पहला कदम है। Tfidf वेक्टराइज़र हमारे sentiment कॉलम से एक और तरीके से वोकैब्युलरी बनाता है।
यह अभ्यास पाठ्यक्रम का हिस्सा है
Python में Sentiment Analysis
अभ्यास निर्देश
sklearn.feature_extraction.textसे TfIdf वेक्टराइज़र बनाने वाला फंक्शन इम्पोर्ट करें।TfidfVectorizer()फंक्शन कॉल करके उसेannakडेटासेट पर fit करें।- वेक्टराइज़र को transform करें।
इंटरैक्टिव व्यावहारिक अभ्यास
इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।
# Import the required function
____
annak = ['Happy families are all alike;', 'every unhappy family is unhappy in its own way']
# Call the vectorizer and fit it
anna_vect = ____.___(annak)
# Create the tfidf representation
anna_tfidf = anna_vect.____(annak)
# Print the result
print(anna_tfidf.toarray())