Zacznij terazZacznij za darmo

Elementy tweeta i spłaszczanie struktury

W strukturze JSON tweeta znajduje się wiele pól zawierających dane tekstowe. W typowym tweecie są to: treść tweeta, opis użytkownika oraz jego lokalizacja. W tweetach dłuższych niż 140 znaków pojawia się zagnieżdżony JSON z rozszerzonym tweetem. Z kolei w przypadku cytowanego tweeta mamy do czynienia zarówno z oryginalną treścią, jak i komentarzem.

W tym ćwiczeniu wyodrębnisz elementy tekstowe z jednego cytowanego tweeta, w którym oryginalny tweet ma więcej niż 140 znaków. Następnie – aby móc analizować tweety na większą skalę – spłaszczysz strukturę JSON tweeta do jednego poziomu. Dzięki temu będzie można przechowywać tweety w formacie DataFrame.

Zmienna quoted_tweet została już załadowana.

To ćwiczenie jest częścią kursu

Analiza danych z mediów społecznościowych w Pythonie

Zobacz kurs

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

# Print the tweet text
print(quoted_tweet[____])

# Print the quoted tweet text
print(quoted_tweet[____][____])

# Print the quoted tweet's extended (140+) text
print(quoted_tweet[____][____][____])

# Print the quoted user location
print(quoted_tweet[____][____][____])
Edytuj i uruchom kod