การเก็บข้อมูลตาม keyword
เมื่อตั้งค่าการยืนยันตัวตนเรียบร้อยแล้ว ก็สามารถเริ่มเก็บข้อมูลจาก Twitter ได้ ขอให้นึกถึง Streaming API ที่ช่วยให้เราเก็บข้อมูล Twitter แบบเรียลไทม์ได้ ไม่ว่าจะเป็นแบบสุ่มตัวอย่างหรือกรองตาม keyword
ในตัวอย่างนี้ เราจะเก็บข้อมูลทวีตที่กล่าวถึง #rstats หรือ #python ในข้อความทวีต ชื่อผู้ใช้ หรือคำอธิบายโปรไฟล์ผ่าน endpoint filter
โมดูล SListener ได้ถูกกำหนดและ import ไว้ให้แล้ว
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
การวิเคราะห์ข้อมูลโซเชียลมีเดียด้วย Python
คำแนะนำการฝึกหัด
- Import
Streamจากtweepy - กำหนดให้
keywords_to_trackเป็นลิสต์ที่มี#rstatsและ#python - ส่งออบเจกต์
authและlistenให้กับStream - กำหนด keyword argument
trackให้เท่ากับkeywords_to_track
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ
ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์
from ____ import ____
# Set up words to track
keywords_to_track = ____
# Instantiate the SListener object
listen = SListener(api)
# Instantiate the Stream object
stream = Stream(____, ____, access_token, access_token_secret)
# Begin collecting data
stream.filter(track = ____)