Tweets laden in een DataFrame
Tijd om gegevens in een pandas DataFrame te importeren zodat we tweets op schaal kunnen analyseren.
We werken met een gegevensset van tweets met de hashtags '#rstats' of '#python'. Deze gegevensset is opgeslagen als een lijst van tweet-JSON-objecten in data_science_json.
Deze cursus raakt veel concepten aan die je misschien bent vergeten. Heb je een snelle opfrisser nodig? Download dan de pandas basics Cheat Sheet en houd hem bij de hand!
Wees je ervan bewust dat dit echte data van Twitter is, en dat er dus altijd een risico is op scheldwoorden of andere aanstootgevende inhoud (in deze oefening en alle volgende oefeningen die ook echte Twitter-data gebruiken).
Deze oefening maakt deel uit van de cursus
Socialmediagegevens analyseren in Python
Oefeninstructies
- Importeer
pandas(onthoud: volgens conventie geven we het aliaspd). - Maak de
data_science_json-tweets plat metflatten_tweets()en sla ze op intweets. - Maak een DataFrame van
tweetsmetpd.DataFrame(). - Print de tekst van de eerste 5 tweets.
Interactieve oefening met praktijkervaring
Probeer deze oefening door deze voorbeeldcode aan te vullen.
# Import pandas
import ____ as ____
# Flatten the tweets and store in `tweets`
tweets = ____(____)
# Create a DataFrame from `tweets`
ds_tweets = ____(____)
# Print out the first 5 tweets from this dataset
print(ds_tweets[____].values[0:5])