Kom igångKom igång gratis

Läsa in tweets i en DataFrame

Nu är det dags att importera data till en pandas DataFrame så att vi kan analysera tweets i större skala.

Vi arbetar med en datamängd av tweets som innehåller hashtaggen '#rstats' eller '#python'. Datamängden är lagrad som en lista med tweet-JSON-objekt i data_science_json.

Den här kursen berör många koncept som du kanske inte har arbetat med på ett tag – om du behöver en snabb repetition kan du ladda ned pandas-snabbreferensen och ha den till hands!

Observera att detta är riktiga data från Twitter, vilket innebär att det alltid finns en risk för förekomst av svordomar eller annat stötande innehåll (i den här övningen och efterföljande övningar som också använder riktiga Twitter-data).

Den här övningen är en del av kursen

Analys av sociala medier i Python

Visa kurs

Övningsinstruktioner

  • Importera pandas (kom ihåg att vi enligt konvention använder aliaset pd).
  • Platta ut tweetarna i data_science_json med flatten_tweets() och lagra dem i tweets.
  • Skapa en DataFrame från tweets med hjälp av pd.DataFrame().
  • Skriv ut texten från de första 5 tweetarna.

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Import pandas
import ____ as ____

# Flatten the tweets and store in `tweets`
tweets = ____(____)

# Create a DataFrame from `tweets`
ds_tweets = ____(____)

# Print out the first 5 tweets from this dataset
print(ds_tweets[____].values[0:5])
Redigera och kör kod