НачатьНачать бесплатно

Сбор данных по ключевым словам

Теперь, когда аутентификация настроена, можно приступить к сбору данных из Twitter. Напомним: Streaming API позволяет получать твиты в режиме реального времени — либо в виде случайной выборки, либо с фильтрацией по ключевому слову.

В нашем примере мы будем собирать твиты, в которых упоминается #rstats или #python — в тексте твита, имени пользователя или описании аккаунта. Для этого используется конечная точка filter.

Модуль SListener уже определён и импортирован за вас.

Это упражнение является частью курса

Анализ данных социальных сетей на Python

Посмотреть курс

Инструкции к упражнению

  • Импортируйте Stream из tweepy.
  • Присвойте переменной keywords_to_track список, содержащий #rstats и #python.
  • Передайте объекты auth и listen в Stream.
  • Задайте именованный аргумент track, присвоив ему значение keywords_to_track.

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

from ____ import ____

# Set up words to track
keywords_to_track = ____

# Instantiate the SListener object 
listen = SListener(api)

# Instantiate the Stream object
stream = Stream(____, ____, access_token, access_token_secret)

# Begin collecting data
stream.filter(track = ____)
Редактировать и запускать код