Sběr dat podle klíčových slov
Teď, když máme nastavenou autentizaci, můžeme začít sbírat data z Twitteru. Připomeň si, že pomocí Streaming API budeme sbírat data z Twitteru v reálném čase – buď jako náhodný vzorek, nebo filtrované podle klíčového slova.
V našem příkladu budeme sbírat data o tweetech, které obsahují #rstats nebo #python v textu tweetu, uživatelském jménu nebo popisu účtu – a to pomocí endpointu filter.
Modul SListener už je za tebe definovaný a naimportovaný.
Toto cvičení je součástí kurzu
Analýza dat ze sociálních sítí v Pythonu
Pokyny k cvičení
- Naimportuj
Streamztweepy. - Nastav
keywords_to_trackjako seznam obsahující#rstatsa#python. - Předej objekty
authalistendoStream. - Nastav pojmenovaný argument
trackna hodnotukeywords_to_track.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
from ____ import ____
# Set up words to track
keywords_to_track = ____
# Instantiate the SListener object
listen = SListener(api)
# Instantiate the Stream object
stream = Stream(____, ____, access_token, access_token_secret)
# Begin collecting data
stream.filter(track = ____)