Zbieranie danych na podstawie słów kluczowych
Teraz, gdy uwierzytelnianie jest już skonfigurowane, możemy zacząć zbierać dane z Twittera. Przypomnij sobie, że Streaming API pozwala zbierać dane w czasie rzeczywistym – albo na podstawie próbki, albo z filtrowaniem według słowa kluczowego.
W naszym przykładzie zbierzemy dane o tweetach zawierających #rstats lub #python w tekście tweeta, nazwie użytkownika lub opisie profilu – korzystając z punktu końcowego filter.
Moduł SListener został już zdefiniowany i zaimportowany.
To ćwiczenie jest częścią kursu
Analiza danych z mediów społecznościowych w Pythonie
Instrukcje do ćwiczenia
- Zaimportuj
Streamz bibliotekitweepy. - Ustaw
keywords_to_trackjako listę zawierającą#rstatsi#python. - Przekaż obiekty
authilistendo funkcjiStream. - Ustaw argument kluczowy
trackna wartośćkeywords_to_track.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
from ____ import ____
# Set up words to track
keywords_to_track = ____
# Instantiate the SListener object
listen = SListener(api)
# Instantiate the Stream object
stream = Stream(____, ____, access_token, access_token_secret)
# Begin collecting data
stream.filter(track = ____)