Läsa in tweets i en DataFrame
Nu är det dags att importera data till en pandas DataFrame så att vi kan analysera tweets i större skala.
Vi arbetar med en datamängd av tweets som innehåller hashtaggen '#rstats' eller '#python'. Datamängden är lagrad som en lista med tweet-JSON-objekt i data_science_json.
Den här kursen berör många koncept som du kanske inte har arbetat med på ett tag – om du behöver en snabb repetition kan du ladda ned pandas-snabbreferensen och ha den till hands!
Observera att detta är riktiga data från Twitter, vilket innebär att det alltid finns en risk för förekomst av svordomar eller annat stötande innehåll (i den här övningen och efterföljande övningar som också använder riktiga Twitter-data).
Den här övningen är en del av kursen
Analys av sociala medier i Python
Övningsinstruktioner
- Importera
pandas(kom ihåg att vi enligt konvention använder aliasetpd). - Platta ut tweetarna i
data_science_jsonmedflatten_tweets()och lagra dem itweets. - Skapa en DataFrame från
tweetsmed hjälp avpd.DataFrame(). - Skriv ut texten från de första 5 tweetarna.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Import pandas
import ____ as ____
# Flatten the tweets and store in `tweets`
tweets = ____(____)
# Create a DataFrame from `tweets`
ds_tweets = ____(____)
# Print out the first 5 tweets from this dataset
print(ds_tweets[____].values[0:5])