Các thành phần của tweet và làm phẳng tweet
Có nhiều trường trong JSON của Twitter chứa dữ liệu dạng văn bản. Trong một tweet điển hình, có phần văn bản của tweet, mô tả người dùng và vị trí người dùng. Với các tweet dài hơn 140 ký tự, sẽ có JSON con extended_tweet. Còn với tweet trích dẫn (quoted tweet), sẽ có cả văn bản tweet gốc và phần bình luận kèm theo trích dẫn đó.
Trong bài này, bạn sẽ trích xuất các thành phần văn bản từ một tweet trích dẫn, trong đó tweet gốc dài hơn 140 ký tự. Sau đó, để phân tích tweet ở quy mô lớn, chúng ta sẽ cần làm phẳng JSON của tweet về một cấp duy nhất. Việc này giúp lưu trữ tweet ở dạng DataFrame.
quoted_tweet đã được nạp sẵn cho bạn.
Bài tập này là một phần của khóa học
Phân tích dữ liệu mạng xã hội bằng Python
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
# Print the tweet text
print(quoted_tweet[____])
# Print the quoted tweet text
print(quoted_tweet[____][____])
# Print the quoted tweet's extended (140+) text
print(quoted_tweet[____][____][____])
# Print the quoted user location
print(quoted_tweet[____][____][____])