शुरू करेंमुफ़्त में शुरू करें

आपका पहला TfIdf

इस अभ्यास में, आप छोटे annak डेटासेट पर TfIdf मेथड लागू करेंगे, जिसमें लियो टॉल्स्टॉय के उपन्यास Anna Karenina का पहला वाक्य है।

आपका कार्य इस डेटासेट के साथ काम करना और TfidfVectorizer() फंक्शन लागू करना है। याद करें, टेक्स्ट का न्यूमेरिक ट्रांसफॉर्मेशन करना, टेक्स्ट के सेंटिमेंट को समझने की दिशा में पहला कदम है। Tfidf वेक्टराइज़र हमारे sentiment कॉलम से एक और तरीके से वोकैब्युलरी बनाता है।

यह अभ्यास पाठ्यक्रम का हिस्सा है

Python में Sentiment Analysis

पाठ्यक्रम देखें

अभ्यास निर्देश

  • sklearn.feature_extraction.text से TfIdf वेक्टराइज़र बनाने वाला फंक्शन इम्पोर्ट करें।
  • TfidfVectorizer() फंक्शन कॉल करके उसे annak डेटासेट पर fit करें।
  • वेक्टराइज़र को transform करें।

इंटरैक्टिव व्यावहारिक अभ्यास

इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।

# Import the required function
____

annak = ['Happy families are all alike;', 'every unhappy family is unhappy in its own way']

# Call the vectorizer and fit it
anna_vect = ____.___(annak)

# Create the tfidf representation
anna_tfidf = anna_vect.____(annak)

# Print the result 
print(anna_tfidf.toarray())
कोड संपादित करें और चलाएँ