Collecter des données sur des mots-clics
Maintenant que l'authentification est en place, nous pouvons commencer à collecter des données Twitter. Rappelez‑vous qu'avec l'API de diffusion en continu (Streaming API), on recueille des données Twitter en temps réel, soit à partir d'un échantillon, soit en les filtrant par mot‑clé.
Dans notre exemple, nous allons recueillir les données de tout tweet mentionnant #rstats ou #python dans le texte du tweet, le nom d'utilisateur ou la description de l'utilisateur à l'aide du point de terminaison filter.
Le module SListener a déjà été défini et importé pour vous.
Cette activité fait partie du cours
Analyser des données de médias sociaux avec Python
Instructions de l’exercice
- Importez
Streamdepuistweepy. - Assignez à
keywords_to_trackune liste contenant#rstatset#python. - Passez les objets
authetlistenàStream. - Définissez le paramètre nommé
trackégal àkeywords_to_track.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
from ____ import ____
# Set up words to track
keywords_to_track = ____
# Instantiate the SListener object
listen = SListener(api)
# Instantiate the Stream object
stream = Stream(____, ____, access_token, access_token_secret)
# Begin collecting data
stream.filter(track = ____)