CommencerCommencez gratuitement

Collecter des données à partir de mots-clés

Maintenant que l’authentification est en place, nous pouvons commencer à collecter des données Twitter. Rappelez-vous qu’avec l’API de Streaming, vous collectez des données Twitter en temps réel, soit via un échantillon, soit en les filtrant par mot-clé.

Dans notre exemple, nous allons collecter les tweets qui mentionnent #rstats ou #python dans le texte du tweet, le nom d’utilisateur ou la description de l’utilisateur, à l’aide de l’endpoint filter.

Le module SListener a déjà été défini et importé pour vous.

Cet exercice fait partie du cours

<cours>Analyser des données de réseaux sociaux en Python</cours>
Voir le cours

Instructions de l’exercice

  • Importez Stream depuis tweepy.
  • Affectez à keywords_to_track une liste contenant #rstats et #python.
  • Passez les objets auth et listen à Stream.
  • Définissez l’argument nommé track égal à keywords_to_track.

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

from ____ import ____

# Set up words to track
keywords_to_track = ____

# Instantiate the SListener object 
listen = SListener(api)

# Instantiate the Stream object
stream = Stream(____, ____, access_token, access_token_secret)

# Begin collecting data
stream.filter(track = ____)
Modifier et exécuter le code