Tweet-items en tweets flattenen
Er staan meerdere velden in de Twitter-JSON met tekstuele data. In een standaardtweet heb je de tweettekst, de gebruikersbeschrijving en de locatie van de gebruiker. In een tweet langer dan 140 tekens staat er een onderliggende extended tweet-JSON. En in een geciteerde tweet heb je de oorspronkelijke tweettekst en het commentaar bij de geciteerde tweet.
In deze oefening haal je tekstuele elementen op uit één geciteerde tweet waarbij de oorspronkelijke tweet meer dan 140 tekens heeft. Vervolgens willen we, om tweets op schaal te analyseren, de tweet-JSON naar één niveau flattenen. Zo kunnen we de tweets opslaan in een DataFrame-formaat.
quoted_tweet is alvast voor je ingeladen.
Deze oefening maakt deel uit van de cursus
Socialmediagegevens analyseren in Python
Interactieve oefening met praktijkervaring
Probeer deze oefening door deze voorbeeldcode aan te vullen.
# Print the tweet text
print(quoted_tweet[____])
# Print the quoted tweet text
print(quoted_tweet[____][____])
# Print the quoted tweet's extended (140+) text
print(quoted_tweet[____][____][____])
# Print the quoted user location
print(quoted_tweet[____][____][____])