Tweetlerden kökler
Bu egzersizde tweets adlı bir dizi ile çalışacaksın. Bu dizi, Twitter'dan toplanan havayolu duygu verilerinin metinlerini içeriyor.
Görevin, bu diziyle çalışarak onu liste üreteci kullanarak bir belirteç (token) listesine dönüştürmek. Ardından, belirteçler listesi üzerinde yineleme yap ve her belirteçten bir kök oluştur. Liste üreteçlerinin, for döngülerine tek satırlık bir alternatif olduğunu unutma.
Bu egzersiz, kursun bir parçasıdır
Python ile Duygu Analizi
Egzersiz talimatları
- Dizgileri köklere dönüştürmek için kullandığımız fonksiyonu içe aktar.
- Az önce içe aktardığın Porter stemmer fonksiyonunu çağır.
- Bir liste üreteci kullanarak
tokenslistesini oluştur. Bu liste,tweetsdizisindeki tüm sözcük belirteçlerini içermeli. tokenslistesi üzerinde yineleme yap ve listedeki her öğeye kök bulma (stemming) fonksiyonunu uygula.
Uygulamalı etkileşimli egzersiz
Bu egzersizi bu örnek kodu tamamlayarak deneyin.
# Import the function to perform stemming
____
from nltk import word_tokenize
# Call the stemmer
porter = ____()
# Transform the array of tweets to tokens
tokens = [____]
# Stem the list of tokens
stemmed_tokens = [[____.____(word) for word in tweet] for tweet in tokens]
# Print the first element of the list
print(stemmed_tokens[0])