More string operators और Twitter
इस अभ्यास में, आप tweets डेटासेट से चुनी गई तीन strings पर अलग-अलग string ऑपरेटर्स लागू करेंगे. आपके लिए एक tweets_list बना दी गई है.
आपको विभिन्न string ऑपरेटर्स लगाकर तीन नई सूचियाँ बनानी हैं:
- केवल अक्षर (letters) रखने वाली सूची
- केवल कैरेक्टर रखने वाली सूची
- केवल अंक (digits) रखने वाली सूची
आवश्यक फंक्शंस आपके लिए nltk से इम्पोर्ट कर दिए गए हैं.
यह अभ्यास पाठ्यक्रम का हिस्सा है
Python में Sentiment Analysis
अभ्यास निर्देश
tweets_listसे टोकन्स की एक सूची बनाएँ.- सूची
lettersमें सभी digits और अन्य कैरेक्टर्स हटा दें, यानी केवल अक्षर रखें. let_digitsमें अल्फ़ान्यूमेरिक कैरेक्टर्स रखें लेकिन बाकी सभी कैरेक्टर्स हटा दें.digitsबनाएँ, जिसमें अक्षर और अन्य कैरेक्टर्स हटा कर केवल संख्याएँ रखी जाएँ.
इंटरैक्टिव व्यावहारिक अभ्यास
इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।
# Create a list of lists, containing the tokens from list_tweets
tokens = [____(item) for item in tweets_list]
# Remove characters and digits , i.e. retain only letters
letters = [[word for word in item if ____.____] for item in tokens]
# Remove characters, i.e. retain only letters and digits
let_digits = [[word for word in item if ____.____] for item in tokens]
# Remove letters and characters, retain only digits
digits = [[word for word in item if ____.____] for item in tokens]
# Print the last item in each list
print('Last item in alphabetic list: ', letters[2])
print('Last item in list of alphanumerics: ', let_digits[2])
print('Last item in the list of digits: ', digits[2])