CommencezCommencez gratuitement

Collecter des données sur des mots-clics

Maintenant que l'authentification est en place, nous pouvons commencer à collecter des données Twitter. Rappelez‑vous qu'avec l'API de diffusion en continu (Streaming API), on recueille des données Twitter en temps réel, soit à partir d'un échantillon, soit en les filtrant par mot‑clé.

Dans notre exemple, nous allons recueillir les données de tout tweet mentionnant #rstats ou #python dans le texte du tweet, le nom d'utilisateur ou la description de l'utilisateur à l'aide du point de terminaison filter.

Le module SListener a déjà été défini et importé pour vous.

Cette activité fait partie du cours

Analyser des données de médias sociaux avec Python

Voir le cours

Instructions de l’exercice

  • Importez Stream depuis tweepy.
  • Assignez à keywords_to_track une liste contenant #rstats et #python.
  • Passez les objets auth et listen à Stream.
  • Définissez le paramètre nommé track égal à keywords_to_track.

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

from ____ import ____

# Set up words to track
keywords_to_track = ____

# Instantiate the SListener object 
listen = SListener(api)

# Instantiate the Stream object
stream = Stream(____, ____, access_token, access_token_secret)

# Begin collecting data
stream.filter(track = ____)
Modifier et exécuter le code