Elementy tweeta i spłaszczanie struktury
W strukturze JSON tweeta znajduje się wiele pól zawierających dane tekstowe. W typowym tweecie są to: treść tweeta, opis użytkownika oraz jego lokalizacja. W tweetach dłuższych niż 140 znaków pojawia się zagnieżdżony JSON z rozszerzonym tweetem. Z kolei w przypadku cytowanego tweeta mamy do czynienia zarówno z oryginalną treścią, jak i komentarzem.
W tym ćwiczeniu wyodrębnisz elementy tekstowe z jednego cytowanego tweeta, w którym oryginalny tweet ma więcej niż 140 znaków. Następnie – aby móc analizować tweety na większą skalę – spłaszczysz strukturę JSON tweeta do jednego poziomu. Dzięki temu będzie można przechowywać tweety w formacie DataFrame.
Zmienna quoted_tweet została już załadowana.
To ćwiczenie jest częścią kursu
Analiza danych z mediów społecznościowych w Pythonie
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Print the tweet text
print(quoted_tweet[____])
# Print the quoted tweet text
print(quoted_tweet[____][____])
# Print the quoted tweet's extended (140+) text
print(quoted_tweet[____][____][____])
# Print the quoted user location
print(quoted_tweet[____][____][____])