Сбор данных по ключевым словам
Теперь, когда аутентификация настроена, можно приступить к сбору данных из Twitter. Напомним: Streaming API позволяет получать твиты в режиме реального времени — либо в виде случайной выборки, либо с фильтрацией по ключевому слову.
В нашем примере мы будем собирать твиты, в которых упоминается #rstats или #python — в тексте твита, имени пользователя или описании аккаунта. Для этого используется конечная точка filter.
Модуль SListener уже определён и импортирован за вас.
Это упражнение является частью курса
Анализ данных социальных сетей на Python
Инструкции к упражнению
- Импортируйте
Streamизtweepy. - Присвойте переменной
keywords_to_trackсписок, содержащий#rstatsи#python. - Передайте объекты
authиlistenвStream. - Задайте именованный аргумент
track, присвоив ему значениеkeywords_to_track.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
from ____ import ____
# Set up words to track
keywords_to_track = ____
# Instantiate the SListener object
listen = SListener(api)
# Instantiate the Stream object
stream = Stream(____, ____, access_token, access_token_secret)
# Begin collecting data
stream.filter(track = ____)