Collecter des données à partir de mots-clés
Maintenant que l’authentification est en place, nous pouvons commencer à collecter des données Twitter. Rappelez-vous qu’avec l’API de Streaming, vous collectez des données Twitter en temps réel, soit via un échantillon, soit en les filtrant par mot-clé.
Dans notre exemple, nous allons collecter les tweets qui mentionnent #rstats ou #python dans le texte du tweet, le nom d’utilisateur ou la description de l’utilisateur, à l’aide de l’endpoint filter.
Le module SListener a déjà été défini et importé pour vous.
Cet exercice fait partie du cours
<cours>Analyser des données de réseaux sociaux en Python</cours>Instructions de l’exercice
- Importez
Streamdepuistweepy. - Affectez à
keywords_to_trackune liste contenant#rstatset#python. - Passez les objets
authetlistenàStream. - Définissez l’argument nommé
trackégal àkeywords_to_track.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
from ____ import ____
# Set up words to track
keywords_to_track = ____
# Instantiate the SListener object
listen = SListener(api)
# Instantiate the Stream object
stream = Stream(____, ____, access_token, access_token_secret)
# Begin collecting data
stream.filter(track = ____)