BaşlayınÜcretsiz başlayın

Token desenini belirt

Bu egzersizde, tweets veri kümesinin text sütunuyla çalışacaksın. Görevin, nesne tipindeki bu sütunu CountVectorizer kullanarak vektörleştirmek. Vektörleştiricide farklı token desenleri uygulayacaksın. Unutma, token desenini belirleyerek bazı karakterleri filtreleyebilirsin.

CountVectorizer senin için içe aktarıldı.

Bu egzersiz, kursun bir parçasıdır

Python ile Duygu Analizi

Kursa Göz Atın

Uygulamalı etkileşimli egzersiz

Bu egzersizi bu örnek kodu tamamlayarak deneyin.

# Build and fit the vectorizer
vect = ____(____=r'\b[^\d\W][^\d\W]+\b').fit(tweets.text)
vect.transform(tweets.text)
print('Length of vectorizer: ', len(vect.get_feature_names()))
Kodu Düzenle ve Çalıştır