Začněte nyníZačněte zdarma

Sběr dat podle klíčových slov

Teď, když máme nastavenou autentizaci, můžeme začít sbírat data z Twitteru. Připomeň si, že pomocí Streaming API budeme sbírat data z Twitteru v reálném čase – buď jako náhodný vzorek, nebo filtrované podle klíčového slova.

V našem příkladu budeme sbírat data o tweetech, které obsahují #rstats nebo #python v textu tweetu, uživatelském jménu nebo popisu účtu – a to pomocí endpointu filter.

Modul SListener už je za tebe definovaný a naimportovaný.

Toto cvičení je součástí kurzu

Analýza dat ze sociálních sítí v Pythonu

Zobrazit kurz

Pokyny k cvičení

  • Naimportuj Stream z tweepy.
  • Nastav keywords_to_track jako seznam obsahující #rstats a #python.
  • Předej objekty auth a listen do Stream.
  • Nastav pojmenovaný argument track na hodnotu keywords_to_track.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

from ____ import ____

# Set up words to track
keywords_to_track = ____

# Instantiate the SListener object 
listen = SListener(api)

# Instantiate the Stream object
stream = Stream(____, ____, access_token, access_token_secret)

# Begin collecting data
stream.filter(track = ____)
Upravit a spustit kód