按关键词收集数据
现在已经完成了认证设置,您可以开始收集 Twitter 数据了。回顾一下,使用 Streaming API 时,您可以基于样本流,或按关键词过滤,来收集实时的 Twitter 数据。
在本例中,我们将使用 filter 端点,收集任何在推文文本、用户名或用户简介中提到 #rstats 或 #python 的推文数据。
SListener 模块已为您定义并导入。
本练习是课程的一部分
在 Python 中分析社交媒体数据
练习说明
- 从
tweepy导入Stream。 - 将
keywords_to_track设为包含#rstats和#python的列表。 - 将对象
auth和listen传给Stream。 - 将关键字参数
track设为keywords_to_track。
交互式实操练习
通过完成这段示例代码来试试这个练习。
from ____ import ____
# Set up words to track
keywords_to_track = ____
# Instantiate the SListener object
listen = SListener(api)
# Instantiate the Stream object
stream = Stream(____, ____, access_token, access_token_secret)
# Begin collecting data
stream.filter(track = ____)