Wczytywanie tweetów do DataFrame
Czas zaimportować dane do DataFrame'a biblioteki pandas, żeby móc analizować tweety na większą skalę.
Będziemy pracować ze zbiorem danych zawierającym tweety z hashtagiem '#rstats' lub '#python'. Zbiór ten jest przechowywany jako lista obiektów JSON tweetów w zmiennej data_science_json.
Kurs porusza wiele zagadnień, które mogły ci wypaść z pamięci – jeśli potrzebujesz szybkiego przypomnienia, pobierz ściągawkę z podstaw pandas i miej ją pod ręką!
Pamiętaj, że są to prawdziwe dane z Twittera, dlatego zawsze istnieje ryzyko wystąpienia wulgaryzmów lub innych nieodpowiednich treści (w tym ćwiczeniu i kolejnych, które również korzystają z rzeczywistych danych z Twittera).
To ćwiczenie jest częścią kursu
Analiza danych z mediów społecznościowych w Pythonie
Instrukcje do ćwiczenia
- Zaimportuj
pandas(zgodnie z konwencją użyj aliasupd). - Spłaszcz tweety z
data_science_jsonza pomocąflatten_tweets()i zapisz wynik w zmiennejtweets. - Utwórz DataFrame z
tweetsprzy użyciupd.DataFrame(). - Wyświetl tekst pierwszych 5 tweetów.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Import pandas
import ____ as ____
# Flatten the tweets and store in `tweets`
tweets = ____(____)
# Create a DataFrame from `tweets`
ds_tweets = ____(____)
# Print out the first 5 tweets from this dataset
print(ds_tweets[____].values[0:5])