Token desenini belirt
Bu egzersizde, tweets veri kümesinin text sütunuyla çalışacaksın. Görevin, nesne tipindeki bu sütunu CountVectorizer kullanarak vektörleştirmek. Vektörleştiricide farklı token desenleri uygulayacaksın. Unutma, token desenini belirleyerek bazı karakterleri filtreleyebilirsin.
CountVectorizer senin için içe aktarıldı.
Bu egzersiz, kursun bir parçasıdır
Python ile Duygu Analizi
Uygulamalı etkileşimli egzersiz
Bu egzersizi bu örnek kodu tamamlayarak deneyin.
# Build and fit the vectorizer
vect = ____(____=r'\b[^\d\W][^\d\W]+\b').fit(tweets.text)
vect.transform(tweets.text)
print('Length of vectorizer: ', len(vect.get_feature_names()))