BaşlayınÜcretsiz başlayın

Tweetlerden kökler

Bu egzersizde tweets adlı bir dizi ile çalışacaksın. Bu dizi, Twitter'dan toplanan havayolu duygu verilerinin metinlerini içeriyor.

Görevin, bu diziyle çalışarak onu liste üreteci kullanarak bir belirteç (token) listesine dönüştürmek. Ardından, belirteçler listesi üzerinde yineleme yap ve her belirteçten bir kök oluştur. Liste üreteçlerinin, for döngülerine tek satırlık bir alternatif olduğunu unutma.

Bu egzersiz, kursun bir parçasıdır

Python ile Duygu Analizi

Kursa Göz Atın

Egzersiz talimatları

  • Dizgileri köklere dönüştürmek için kullandığımız fonksiyonu içe aktar.
  • Az önce içe aktardığın Porter stemmer fonksiyonunu çağır.
  • Bir liste üreteci kullanarak tokens listesini oluştur. Bu liste, tweets dizisindeki tüm sözcük belirteçlerini içermeli.
  • tokens listesi üzerinde yineleme yap ve listedeki her öğeye kök bulma (stemming) fonksiyonunu uygula.

Uygulamalı etkileşimli egzersiz

Bu egzersizi bu örnek kodu tamamlayarak deneyin.

# Import the function to perform stemming
____
from nltk import word_tokenize

# Call the stemmer
porter = ____()

# Transform the array of tweets to tokens
tokens = [____]
# Stem the list of tokens
stemmed_tokens = [[____.____(word) for word in tweet] for tweet in tokens] 
# Print the first element of the list
print(stemmed_tokens[0])
Kodu Düzenle ve Çalıştır